中国の人工知能研究所 DeepSeek は、2026 年 7 月 31 日に V4-Flash「0731」をリリースしました。これは、サードパーティのベンチマークで OpenAI の GPT-5.6 Luna にほぼ匹敵する、約 60% 低いコストの低予算モデルの再トレーニング版です。このリリースは、モデルのパブリックベータ API を一般提供するもので、中国のオープンウェイトプロバイダーと西側のフロンティアラボの間で激化する価格競争における最新の一斉攻撃となる。モデル戦争に関する継続的な報道については、最新の AI ニュース をチェックしてください。
The Decoder によると、新バージョンは Artificial Analysis Intelligence Index で 50 ポイントを獲得しており、2026 年 4 月に発売された以前の V4-Flash を 10 ポイント上回っています。これは、OpenAI が最近 80% 値下げした後でも、タスクあたりのコストが約 60% 低いにもかかわらず、OpenAI の低価格帯の GPT-5.6 Luna よりわずか 1 ポイントの差に位置しています。
エージェント作業用に構築
最大のメリットは、エージェント タスク、つまり現実世界の複数ステップの作業を自律的に完了できる機能です。 TechNode は、このモデルのスコアが Terminal Bench 2.1 で 82.7、DeepSWE で 54.4 であると報告しました。この 2 つのベンチマークは、AI がツールを使用し、コードを書き、手を握ることなくエンジニアリング上の問題をどれだけうまく解決できるかを測定するために設計されました。
複雑な事務作業に関するモデルをテストするベンチマークである GDPval では、V4-Flash は Elo ポイントが 1,189 から 1,559 に上昇しました。 DeepSeekはまた、このモデルは以前のモデルよりも幻覚の頻度が少なく、同じタスクを完了するのに使用するトークンの量が約12パーセント少ないと述べた。
同じアーキテクチャ、よりスマートな重み
アップグレードでは、同じ基本構造が維持されます。つまり、合計 2,840 億のパラメーターと、常に 130 億がアクティブになり、100 万のトークンのコンテキスト ウィンドウが維持されます。 DeepSeek はモデルを拡大するのではなく、モデルを再トレーニングし、同じフットプリントからより多くのパフォーマンスを絞り出しました。モデルのウェイトは、DeepSeek のオープンウェイト アプローチを継続し、Hugging Face の寛容な MIT ライセンスの下でリリースされます。
DeepSeek はリリースの範囲を慎重に検討しました。このアップデートは V4-Flash API にのみ適用されます。上位層の V4-Pro API と、DeepSeek のコンシューマ アプリおよび Web サイトを通じて提供されるモデルは変更されません。新しい Flash API には、Responses API のサポートも追加され、Codex での使用に適応されており、コーディング エージェントを構築する開発者にとってその魅力がさらに広がります。
キャッシュ割引エッジ
DeepSeek のコスト上の利点の重要な部分は、その価格設定の仕組みによるものです。同社は、業界標準の 90 パーセントをはるかに上回る 98 パーセントのキャッシュ割引を提供しています。これは、リクエストの繰り返しまたは予測可能な部分に対して、通常の料金のごく一部の料金が請求されることを意味します。タスクあたりのトークンの数が少ないことと組み合わせると、多くのワークロードの実効コストが大幅に削減されます。
この価格体系は、市場シェアを守るために価格を引き下げてきたOpenAIにとって直接的な挑戦である。その結果、市場ではフロンティアに近い品質が商品になりつつあり、競争は本来の能力ではなくインフラの効率性とユニットエコノミクスによって決定されることが増えています。
底なしの価格競争
この発表により、アナリストが現在本格的な価格戦争と表現している状況が激化している。 OpenAI は開発者基盤を守るために GPT-5.6 Luna の価格を 80% 引き下げましたが、DeepSeek は同等の機能を備えながらもはるかに安価なモデルで回答しました。ラウンドごとに、ニアフロンティアインテリジェンスの実効コストは低くなり、最も安価な有能なモデルと最も高価な有能なモデルとの差は縮小し続けています。
このダイナミックさはソフトウェアでは珍しいものです。ほとんどの市場では、ほぼ同等の品質で 60% のコスト優位性があれば、急速にシェアを獲得できます。ここでは、数週間以内にアドバンテージが一致して再一致し、開発者は常に変動するリーダーボードを手にすることになります。かつてはフロンティアラボの独占的領域だったベンチマークパリティは、体重と価格の両方を公開する意欲のある無差別級挑戦者から利用できるようになってきている。
開発者にとっての意味
開発者にとって、実際的な意味合いは明らかです。有能なエージェント モデルが急速に安価になっています。自律的に端末を操作し、コードを記述してデバッグし、複雑なオフィス タスクを処理できるモデルは、すべてリクエストあたり数セントで実現でき、AI を活用した製品を構築する経済性が変わります。
オープンウェイト リリースは、チームが独自のハードウェアでモデルを実行できることも意味し、機密性の高いワークロードに対するトークンごとの API 料金を完全に回避できます。 DeepSeek や OpenAI などが価格とパフォーマンスで相打ちを続ける中、勝者となるのは、現在、選択肢となる高機能かつ手頃な価格のモデルのメニューが増えているビルダーです。
AI 曲線の先を行く
人工知能をめぐる状況はこれまで以上に速く変化しており、この変化を早期に追跡する企業は永続的な優位性を獲得します。モデルのリリース、資金調達ラウンド、政策の動きに関する情報源を確認した継続的な報道については、最新の AI ニュース をフォローしてください。
AI ニュースをもっと読む→