DeepSeek は、プラットフォーム全体の価格を大幅に引き上げながら、API ラインナップを新しい主力モデル V4 Pro で更新しました。これは、中国の研究所を有名にし、ライバルを価格競争に追い込んだ最低価格戦略からの決定的な転換です。 DeepSeekのあらゆる値下げを市場を動かすイベントとして追跡してきた業界にとって、この反転は同様に重要である。モデル市場の最新情報については、AI ニュースをフォローしてください。
今週更新された同社の公式 API ドキュメントには、DeepSeek-V4-Flash-0731 バージョンを実行する deepseek-v4-flash と、新しい DeepSeek-V4-Pro-0813 ビルドを実行する deepseek-v4-pro の 2 つのモデルがリストされています。どちらも 100 万トークンのコンテキスト ウィンドウ、最大 384,000 トークンの最大出力、デュアル思考モードと非思考モードを提供し、どちらも Claude Code、GitHub Copilot、OpenCode などのエージェント ツール内のバックエンド モデルとして使用できます。 DeepSeekはエージェント開発者向けのツールキット「DeepSeek Harness」の開発者プレビューも出荷している。 この件の詳細は、AIの最新動向をご覧ください。
V4 Pro の価格
DeepSeek の公開価格によれば、新しいフラッグシップ製品は、どの階層でも Flash のちょうど 3 倍の価格が設定されています。 V4 Pro では、100 万トークンあたり、キャッシュされた入力トークンが 0.022 ドル、オフピーク時の非キャッシュ入力が 0.66 ドル、100 万出力トークンあたり 1.98 ドルとなります。ピーク時には、これらの数字は 0.044 ドル、1.32 ドル、3.96 ドルと 2 倍になります。比較すると、V4 Flash の価格は、キャッシュ ヒットが $0.007/$0.014、キャッシュ ミスが $0.22/$0.44、出力が $0.66/$1.32 です。
ピーク時間は 01:00 ~ 04:00 および 06:00 ~ 10:00 UTC として定義され、オフピーク料金はピークのちょうど半分に設定されます。同時実行にも段階があります。Flash の顧客は 2,500 の同時リクエストを取得できますが、Pro アカウントの上限は 500 です。
価格が 10 倍も上昇
このローンチは、DeepSeek の価格変革を見逃すことができなくなった 1 週間に上限を設けています。ウォール・ストリート・ジャーナルは8月14日、ディープシークがAIモデルの価格を約4倍に引き上げたと報じた。 InfoWorldは同日、AI需要が同社の生産能力を圧迫しているとして、一部のV4の価格が10倍以上に高騰していると報じた。 Engadget は読者に対し、これらのモデルの価格は「約 4 倍になる」と語った。
Tech Times は 8 月 17 日までに、V4 API の価格がピーク時に 4 倍になったと報じ、一方、韓国のソウル経済新聞は、最も急激な値上がりは最大 12 倍であり、この動きを中国の AI 競争が利益に転換することであると枠組みづけた。中国国営紙環球時報は、今回の引き上げは「より健全な商業化」を推進する一環であると述べ、これは中国政府が市場シェアだけでなく持続可能なユニットエコノミクスをAI擁護者にとっての優先事項と考えていることの表れであると述べた。
価格競争の武器からプレミアム製品へ
戦略の転換は著しい。 DeepSeek は、積極的な価格設定で世界的な評判を築きました。7 月下旬、新しくリリースされた V4 フラッシュ モデルは、60% 低いコストで OpenAI の GPT-5.6 Luna に匹敵するベンチマークが行われ、あらゆる API プロバイダーを圧迫する最下位への競争が加速しました。現在、同じラボはプレミアム料金を請求しています。V4 Pro のピーク出力価格である 100 万トークンあたり 3.96 ドルは、Flash 時代の顧客が支払い慣れていた価格をはるかに上回っています。
ピーク時間帯とオフピーク時間帯の導入自体が容量管理ツールです。最も混雑する時間帯には 2 倍の料金を請求し、プレミアム モデルの同時実行数を削減することで、DeepSeek は利益率の高いワークロードに向けて計算を割り当てられるようになり、これはクラウド プロバイダーや電力市場でよく知られている戦略です。
エージェント時代の 2 層ポートフォリオ
2 つのモデル間の分割は、異なる購入者向けに設計されています。 Flash は、2,500 リクエストの同時実行制限と最小限のキャッシュ ヒット料金設定により、大量の運用トラフィックやコスト重視のアプリケーション向けに位置付けられています。 Pro は、同時リクエストが 500 件で、価格が 3 倍になっており、100 万トークンのコンテキスト ウィンドウと 384,000 トークンの出力上限が重要となる推論の多いワークロード、つまり長いエージェント セッション、大規模なコードベース分析、ドキュメントの多いパイプラインをターゲットとしています。
DeepSeek は、すでに開発を行っている開発者にもアプローチしています。どちらのモデルも、Claude Code、GitHub Copilot、OpenCode 内のバックエンドとして直接使用でき、API は OpenAI と Anthropic 互換形式の両方に対応します。つまり、欧米のプロバイダーからの移行は 1 行の構成変更で済むことになります。新しい「DeepSeek Harness」開発者プレビューは、その戦略をエージェント ハーネス ビルダーにも拡張します。
開発者にとっての意味
DeepSeek が常にお買い得なオプションであるという前提でコスト重視のアプリケーションを構築してきた開発者にとって、少なくとも中国の研究所においては、トークン価格が際限なく下落する時代は終わったというメッセージです。キャッシュに優しいアーキテクチャでは、どちらのモデルでもキャッシュ ミス コールよりも 30 分の 1 低い入力レートが支払われるようになり、プロンプト キャッシュの規律がモデルの選択よりもはるかに価値のあるものになっています。そして、より広範な市場にとって、DeepSeekのピボットは、最も積極的な価格設定者を市場のフロアから排除することになる。これは、一年を通じて機能だけでなくコストでも競争してきたOpenAI、Anthropic、Googleへの静かな贈り物である。
V4 Pro のベンチマークがプレミアムを正当化するかどうかは、独立した評価者によってまだテストされていません。すでに明らかなことは、ビジネス ロジックです。2 年間にわたって世界の AI 利用に補助金を提供してきた後、DeepSeek はその対価を受け取りたいと考えています。
---
AIの最新情報をお届けAIの最新ニュース、分析、ブレイクスルーを一箇所で。
AIニュースをもっと読む →