Cerebras Systems と OpenAI は、OpenAI API で最初に開始され、Cerebras のウェーハスケール テクノロジーを活用した新しいサービス層である Ultrafast Mode の初期の様子を共有しました。このパートナーシップにより、GPT-5.6 Sol は 1 秒あたり最大 750 の出力トークンで実行できるようになり、フロンティアレベルのインテリジェンスをリアルタイムの速度で提供できます。 AI ハードウェアの最新ニュースについては、AI Buzz Wire をご覧ください。

スピードとインテリジェンスのトレードオフを排除する

AI 構築者は長い間、基本的なトレードオフに直面してきました。モデルのサイズとインテリジェンスがスケールアップするにつれて、計算コストとデータ移動コストが増加し、応答時間が遅くなります。開発者は、高品質の結果を待つか、短期間で劣った結果を受け入れるかの選択を迫られました。

超高速モードの GPT-5.6 Sol は、このジレンマを解決するように設計されています。 Cerebras によると、Artificial Analysis によって報告された出力速度に基づくと、このサービスは、高速モードでは Anthropic の Claude Fable 5 より 11 倍、Opus 4.8 より 5 倍高速に実行されます。

人類最後の試験: スピードテスト

Cerebras は、Humanity's Last Exam (HLE) で競合モデルに対して Ultrafast をテストしました。HLE は、通常、化学、経済学、文学などの分野で博士号を取得した人のみが回答できる 2,500 の質問で構成される挑戦的なベンチマークです。

Cerebras が実施した評価では、超高速モードの GPT-5.6 Sol は 2,500 の HLE 質問すべてに 11 時間 11 分で回答しました。 Claude Fable 5 では、同じ結論に達するまでに 78 時間 27 分、つまり 3 日以上の継続的な計算が必要でした。言い換えれば、Ultrafast は人間の知識の最前線を 1 営業日で処理し、ほぼ 7 倍の速さで同等の精度を達成しました。

ベンチマークは、7 月 10 日に GPT-5.6 Sol Ultrafast と Codex を高推論設定で使用し、7 月 13 日から 15 日まで高推論設定で Claude Fable 5 と Claude Code を使用して Cerebras によって実行されました。

現実世界のビジネスへの影響

経済的に価値のあるナレッジ ワーク タスクのベンチマークである GDP-Val において、Ultrafast は品質を低下させることなく 5.6 倍のエンドツーエンドの高速化を実現しました。これは、推論を高速化することで、出力品質を犠牲にすることなく、経済的に価値のある作業をいかに加速できるかを示しています。

Cerebras は、Ultrafast を、一秒一秒が重要なシナリオのためのツールとして構想しています。 Web サービスを運営する企業は、このテクノロジーを使用して、生産停止の根本原因をより迅速に特定して対処し、顧客の信頼を維持し、収益の損失を防ぐことができます。一か八かのサイバーセキュリティ状況では、セキュリティ チームは Ultrafast を活用して攻撃を迅速に検出し、対応できます。

スピードを支えるテクノロジー

パフォーマンスの利点は、フロンティア AI ワークロード専用に構築された Cerebras の Wafer-Scale Engine アーキテクチャに由来しています。高速フロンティア推論の中心的な課題は、データ移動の問題です。従来の GPU では、連続するトークンを生成するためにモデルの重みをオンチップ メモリとオフチップ ストレージの間で繰り返し転送する必要があるため、大規模モデルの推論はメモリ帯域幅によってボトルネックになります。

Cerebras は根本的に異なるアプローチを採用しています。各ウェハサイズのチップは、シリコン上に 44 GB の SRAM を直接実装しています。モデルの重みはチップ上に留まり、トークンはウェーハ間でパイプライン化されたモデル層を途切れることなく流れます。これにより、GPU ベースの推論を遅らせる非効率なデータ移動が排除され、モデル サイズに合わせてスムーズにスケーリングできるため、将来のフロンティア モデルで継続的な速度の優位性が得られる道が開かれます。

可用性と市場での位置づけ

超高速モードの GPT-5.6 Sol は現在、一部の顧客に限定的にプレビューで提供されており、容量の増加に応じてアクセスも時間の経過とともに拡大します。 Cerebras は、このパートナーシップが AI イノベーションの次の波を推進し、組織がレスポンシブ AI で達成できることの上限を引き上げるものであると説明しています。

この提携は、GPU が支配する AI ハードウェア市場に代わるものとしてウエハースケール コンピューティングを長年追求してきた Cerebras にとって、重要なマイルストーンとなります。 Cerebras は、OpenAI と直接提携して、利用可能な最も有能なフロンティア モデルの 1 つを高速化することで、そのアーキテクチャが高速推論ワークロードに対して真の競争上の優位性を提供することを強く主張しています。

モデルがより大規模になり、よりインテリジェントになるにつれて、リアルタイムの速度でモデルにサービスを提供する機能が、AI インフラストラクチャ市場における競争を決定づける要素になる可能性があります。 Cerebras と OpenAI のパートナーシップは、推論速度の競争がモデルの知能の競争と同じくらい重要になっていることを示しています。

AI の一歩先を行く

AI ハードウェアのニュース、モデルのパフォーマンス分析、業界の発展について詳しくは、AI Buzz Wire をブックマークしてください。

AI ニュースをもっと読む→