Anthropic は、2026 年 9 月 1 日に Claude Fable 5.1 と Claude Mythos 5.1 をリリースし、同社がコーディングとナレッジ ワーク用の世界で最も先進的なモデルと呼ぶものを導入し、AI システムが科学研究にどのように貢献するかを初期に垣間見ることができました。 Anthropic の Web サイトで公開されたこの発表は、コスト、プライバシー、安全対策に関する顧客のフィードバックに直接対応する一連の価格設定およびデータ処理の変更とともに行われました。

異例の 2 つの名前での発売は、2 つのセーフガード構成を持つ 1 つの基礎モデルを反映しています。 Fable 5.1 は一般にすべてのユーザーが利用できますが、Mythos 5.1 は Anthropic の信頼できるアクセス プログラム用に予約されており、その保護機能はサイバーセキュリティとライフ サイエンスの作業をサポートするように特別に設計されています。 AWS は同日、「AWS での Claude Fable 5.1 の紹介」と題した発表記事で Fable 5.1 が自社のプラットフォームで利用可能であることを確認し、このニュースは Hacker News のトップに上り詰め、公開から数時間以内に 600 ポイント以上を獲得しました。この記事の詳細については、現在進行中の 最新 AI ニュース の報道をご覧ください。

価格引き下げとデータ保持の譲歩

ほとんどの顧客にとってヘッドラインの変化はコストです。 Anthropic によると、使用量がトークンによって課金される場合、Fable 5.1 は一般的なワークロードのコストが Fable 5 よりも推定 25% 低くなります。この削減は、モデルがすでに処理および保存されている入力を読み取るときのキャッシュ読み取りの料金が引き下げられることによって実現します。高度にエージェント的な作業の場合、節約効果はさらに大きくなり、最大約 45% に達することが多いと同社は述べています。

より大きな構造変化は、同社がエンタープライズ・フロンティア・セーフガード(EFS)と呼ぶ新しいシステムだ。 Anthropic によれば、EFS は敵対的な使用に対する最先端の保護を維持しながら、企業顧客に完全なプライバシー (データ保持ゼロ ポリシーと同等) を提供します。このメカニズムは、Anthropic ではなく顧客によって完全に制御されるクラウド インフラストラクチャに顧客データを保存することによって機能します。 EFS は今秋後半から段階的に企業顧客に展開され、一般提供されるまで、対象となる顧客はデータ保持なしで Fable 5.1 を実行できます。

プライバシーに関する譲歩は、目に見える顧客の反発に続いて行われます。 CNBC は 9 月 1 日、Anthropic が顧客からの反対を受けてデータ保持ポリシーを変更したと報じました。EFS の発表は、Anthropic のインフラストラクチャにデータを置かずにフロンティア モデルの機能を必要とする企業に対する同社のこれまでで最も具体的な対応です。

コーディングとサイエンス全体でベンチマークが向上

Anthropic が公表した評価では、前世代に比べて大幅な飛躍が示されていますが、数値は同社独自のテストに基づいたものであり、それに応じて読む必要があります。

エージェント科学研究のベンチマークである Terminal-Bench-Science 0.1 では、同じ設定での Fable 5 のスコアが 24.7% だったのに対し、Fable 5.1 のスコアは 52.6% でした。同じベンチマークで、Claude Opus 5 は 29.0% のスコアを記録し、OpenAI の GPT-5.6 Sol は 22.4% のスコアを記録しました。端末ベースのエージェント コーディング テストである Terminal-Bench 4.0 では、Fable 5.1 のスコアは 55.8% でしたが、より軽い保護機能を備えた Mythos 5.1 のスコアは 60.9% に達し、Fable 5 の 42.0% を上回りました。

知識労働とコンピュータ使用の指標も改善されました。 Fable 5.1 の GDPval-AA v2 評価スコアは 1853 でしたが、Fable 5 のスコアは 1723 で、人類最後の試験ではツールなしで 60.9%、ツールありで 65.0% に達しました。コーディングベンチマークである CursorBench 3.2.0 では、Fable 5 の 70.5% に対して 73.4% のスコアを記録しました。コンピュータの使用では、OSWorld 2.0 で部分スコアが 77.9%、厳密スコアが 41.7%、AutomationBench でスコアが 31.4% となり、前バージョンの 17.1% から増加しました。

Anthropic は重要な注意点も明らかにしました。Fable 5.1 は本番環境の安全対策が有効な状態で評価され、それらの安全対策が介入するタスクではモデルのスコアは 0 でした。この要因が一部のベンチマークで結果を低下させる可能性があると同社は述べています。

同社は、労力の設定がコストに影響を与えると指摘しました。 Fable 5.1 のデフォルトは、Claude Code では高労力、Claude Cowork と Claude.ai では中程度の労力であり、より低い労力レベルでは、はるかに低いコストで Fable 5 と同等かそれ以上の結果を達成します。

初期の顧客は生産性の向上を報告

Anthropic は、早期アクセス パートナーからの、機能と経済性の両方を強調した紹介文を公開しました。コグニションは、ローンチ日にデヴィンのオーパス 5 トラフィックをフェイブル 5.1 に移行すると発表した。 Cognition の共同創設者兼最高製品責任者である Walden Yan 氏は、「テストではタスクあたりのコストが低く、Fable 5 に匹敵するか、それを上回っていました。新しいキャッシュ読み取りの価格設定により、Fable クラスのモデルは、コード レビューから始めて、Opus に維持していたワークロードにとってついに経済的になりました」と述べています。

定量的取引会社ミレニアムは、デバッグに関する印象的な逸話を提供しました。ある上級ポートフォリオマネージャーは、まれなクラッシュ(およそ100万回に1回の頻度)が同社のエンジニアには4~5年間原因不明であり、彼が試したモデルはすべて失敗したと述べた。 Fable 5.1 では、外部ベンダーのライブラリを逆アセンブルし、コア ダンプと照合し、クラッシュの原因がそのライブラリのバグであることを突き止めました。

メディア会社エブリーのダン・シッパー最高経営責任者(CEO)は、テストでこのモデルはオーパス5の約2倍の速度でありながら、半分のトークンを使用したと述べた。そして、法人カードの新興企業である Ramp は、モデルが以前の機械学習の結果をラベルのアーティファクトと診断し、それを修正し、一晩で 6 つの並列実験を開始し、結果と次のステップを返す 38 時間の無人実行について説明しました。

よりソフトな安全装置、紐付き

安全面では、アンスロピックは、最新の安全対策により、サイバーセキュリティにおける誤検知が以前よりも 60% 減少したと述べました。同社はまた、機能の移行も開始しました。Fable 5.1 は、ソフトウェアの脆弱性を発見するために使用できるようになりましたが、脆弱性を悪用する開発には使用できませんでした。

生物学では、Mythos 5.1 の高度な機能へのアクセスは、米国政府と提携して開発されたプログラムを通じて実行され、科学者の登録は間もなく開始される予定です。同社は今年初めにすでにフェイブル5に対する生物学関連の保護を強化しており、今回の同時発売はその方針の転換ではなく、その継続となる。

なぜそれが重要なのか

今回のローンチは、推論価格が急速に下落している市場に上陸した。AI Buzz Wire の分析では、トークン価格が過去最低値を記録していることが最近判明した。Anthropic は明らかに、プレミアム料金を守るのではなく、エージェントのワークロードの価格パフォーマンスで競争することを選択している。 OpenAI の GPT-5.6 Sol および自社の Opus 5 製品ラインとの比較結果が公開されており、同社は Fable 5.1 を長期にわたるコーディングおよび研究タスクのデフォルトの選択肢として位置づけています。独立した評価と企業による採用によってこの提案が裏付けられるかどうかは、今後数週間のうちに明らかになるでしょう。

---

AI の先を行く

最新の AI ニュース、分析、画期的な情報をすべて 1 か所で入手できます。

AI ニュースをもっと読む→