Anthropic は、Claude Opus 5 を発表しました。これは同社によれば、最上位モデルの Fable 5 モデルのおよそ半額で、ほぼフロンティアのインテリジェンスを提供するという新しい AI モデルです。 2026 年 7 月 24 日にリリースされた Opus 5 は、Claude Max のデフォルト モデルであり、Claude Pro で利用可能な最も強力なモデルとなり、コーディング、自律エージェント、および専門知識の作業のための Anthropic の日常の主力モデルとして位置付けられています。
この発表は、企業が AI への支出を精査している時期に行われた。 CNBC によると、新モデルは「Fable 5 に匹敵し、企業がコストを心配しているため安価」である一方、ブルームバーグはそれを「日常業務にとってよりコスト効率の高いモデル」と特徴づけている。最新の AI 開発 を追跡しているチームにとって、Opus 5 は、次の競争の戦場は生のベンチマークの優位性ではなく、価値であるという意図的な賭けを表しています。
ベンチマーク パフォーマンス: コーディングとナレッジ ワークに関する新しい最先端
Anthropic の報告によると、Opus 5 には、Frontier-Bench や GDPval-AA を含むコーディングと知識労働の評価に関する最先端の結果が掲載されています。 Frontier-Bench v0.1 では、Opus 5 は他のすべてのモデルを上回り、前世代の Opus 4.8 の 2 倍以上のパフォーマンスを、より低いタスクあたりのコストで実現していると同社は述べています。
Anthropic 独自のベンチマークによると、CursorBench 3.2 では、Opus 5 は Fable 5 のピーク スコアの 0.5% 以内に収まり、タスクあたりのコストは半分です。 Decryptは、このモデルが「半分の価格で、ほとんどのベンチマークでFable 5を上回っている」と指摘した。
利点は、エージェントおよび問題解決の評価にも及びます。
- ARC-AGI 3: Opus 5 は、この斬新な問題解決テストにおいて、次に優れたモデルよりもおよそ 3 倍高いスコアを獲得しました。
- Zapier AutomationBench: エンドツーエンドのビジネス タスクの完了を測定し、同じコストで次に優れたモデルの約 1.5 倍の合格率。
- OSWorld 2.0 (コンピュータ使用): Opus 5 は、コストの 3 分の 1 強で、Fable 5 の最高の結果を上回りました。
特に、Anthropic は、Opus 5 が「サイバーセキュリティの課題において Mythos 5 に後れをとっている」ことを認めており、この分野ではライバルのフロンティアモデルがリードを維持している。
より強力な代理店と自己検証
発表の中で繰り返されるテーマは、Opus 5 の自身の作業を検証し、成功するまで反復する能力の向上です。 Anthropic は、この自律性を強調する早期アクセス テストの例をいくつか説明しました。
ある Frontier-Bench タスクでは、モデルに機械部品の図面が与えられ、それを 3D FreeCAD モデルとして再構築するコードを書くように求められましたが、図面を直接表示する方法は意図的に与えられていませんでした。 Opus 5 は、生のピクセルからジオメトリを抽出する独自のコンピューター ビジョン パイプラインを作成し、その部分全体を再構築し、競合するモデルが 5 回試行してもタスクを解決できなかった場合に繰り返し成功したと報告されています。
一般的なオープンソース パッケージ マネージャーの実際のバグを考慮すると、Opus 5 は根本原因を見つけて、コミュニティ独自のパッチが見逃していたエッジ ケースを修正しましたが、競合モデルは表面的な症状のみを修正し、バグが解決したと宣言しました。伝えられるところによると、ある商社のエンジニアは、Opus 5 を使用して、新しい取引所の市場データ フィードを 1 回のセッションで構築しました (これまでのモデルではまったく完了できなかったタスクです)。そして、検証するためのライブ フィードが見つからなかったため、モデルは独自のテスト ハーネスを構築しました。
お客様受付
早期アクセス パートナーは、おおむね肯定的な評価を提供しました。 Cognition (Devin コーディング エージェントのメーカー) の CEO、Scott Wu 氏は、Opus 5 は「半分のコストで Fable レベルのパフォーマンスに近づき」、「難しいデバッグや根本原因分析のタスクに特に強みを発揮する」と述べました。 Cursor の共同創設者である Sualeh Asif 氏は、このモデルは「Opus の速度とコストで Fable 5 に近いインテリジェンス」を提供すると述べました。
Zapier の CEO、Wade Foster 氏は、Opus 5 が「以前の Claude モデルよりも多くのトークンを費やすことなく、Zapier の AutomationBench リーダーボードのトップに立った」と報告し、リスクのあるアカウントにフラグを立て、適切な所有者に警告し、保持チームに向けて要約するという完全なチャーン防止ワークフローをエンドツーエンドで完了しました。以前のモデルは合格しませんでした。 Opus 5 は 100% に達しました。
科学研究における成果
Anthropic はまた、科学研究における Opus 5 の改善点も強調しました。このモデルは、構造生物学、有機化学、バイオインフォマティクスを含む、Anthropic のライフサイエンス評価のすべてにおいて Opus 4.8 を上回っています。同社は、社内の有機化学ベンチマーク (分光学データからの分子構造の推定) が 10.2 パーセントポイント向上し、タンパク質の機能予測タスクが 7.7 ポイント向上したと指摘しました。あるゲノミクス顧客は、このモデルが「より慎重な科学者のように」動作し、適切な統計テストに手を伸ばし、自身の結果をクロスチェックしていると述べました。
価格戦略
Anthropic は、Fable 5 のインテリジェンスに近づきながら、Opus 5 を Opus 4.8 と同じレベルの価格設定にすることで、中堅製品と主力製品の間のギャップを効果的に縮めています。 VentureBeat は、このリリースを「コーディング、エージェント、エンタープライズ ワークフロー向けの安価な AI モデル」と位置づけ、Seeking Alpha は、Opus 5 が「フロンティア モデル Fable 5 に近く、安価である」と述べました。同社は調整可能な「労力」設定を提供しており、顧客はインテリジェンスと引き換えに速度とトークンコストの削減を実現し、タスクごとのコストパフォーマンス比を微調整できます。
AI 競争にとってそれが何を意味するか
Opus 5 は、ニアフロンティア AI のコストがいかに急速に低下しているかを強調しています。トークン価格の半分で、利用可能な最も性能の高いシステムに匹敵するモデルは、競合他社にわずかな利益のためにプレミアム価格を正当化するよう圧力をかけます。 Anthropic、OpenAI、Google などが、毎日の大規模な導入に十分な手頃な価格の有能なモデルを開発しようと競い合っているため、企業にとっての疑問は「どのモデルが最もスマートか?」という問題に移りつつあります。 「1 ドル当たり最も多くのインテリジェンスを提供するモデルはどれですか?」
Anthropic にとって、メッセージは明確です。高度な推論はもはや贅沢品ではありません。 Opus 5 は、フロンティアに隣接した機能を、継続的な毎日の導入を現実的な価格帯で実現します。これは、すべての中で最も重要な詳細であることが判明する可能性があります。
AI の先を行く
Claude Opus 5 は本日より Claude Pro、Claude Max、および Anthropic の API 経由で利用可能になります。この話と、より広範な人工知能の状況について詳しく知りたい場合は、AI ニュース速報 を随時更新してください。
AIニュースをもっと読む→