Anthropic は火曜日に Claude Haiku 5.5 をリリースし、これを「これまでにリリースした中で最も安価、最速、そして最も機能的な小型モデル」と説明しました。この発売には、ほとんどのリクエストで入力コストが 100 万トークンあたり 0.10 ドルに引き下げられる 2 段階の大幅な値下げが伴い、この動きは小型モデルセグメントで OpenAI の GPT-6 Luna に直接圧力をかけ、AI 業界全体で数か月にわたる価格戦争を拡大することになります。

2026 年 10 月 7 日に Anthropic の Web サイトで公開されたこの発表では、Haiku 5.5 を Sonnet 5.5 および Opus 5.5 と並ぶ、Claude 5.5 ファミリーの 3 番目のモデルとして位置づけています。ロイターは、今回のリリースを、Anthropic が予定されている IPO の準備としてモデルのラインナップを拡大するものであると特徴づけており、このモデルはすでに GitHub Copilot、アマゾン ウェブ サービス、Google Cloud、Microsoft Foundry で利用可能となっています。この発表は、モデルのリリース、値下げ、政策の動きがほぼ毎日行われている AI ニュース速報 の 1 か月間の最新のエントリーです。

大量の作業向けに構築された小型モデル

Anthropic によると、Claude Haiku 5.5 はフロンティアレベルの推論ではなく、大量のコストを重視するタスク向けに設計されています。同社は、要約、圧縮、データベースクエリ、分類リクエストなどの「迅速かつ反復的なワークロードを確実に処理する」と述べている。

Anthropic はまた、新しいモデルを自社の大規模システムのコンパニオンとして位置づけています。Haiku 5.5 は「コーディング作業のサブエージェントとして Opus 5.5 および Sonnet 5.5 とよく連携」しており、開発者は複雑な推論のために大きなモデルを確保しながら、安価で高速なサブタスクを Haiku にルーティングできます。これは標準速度で Anthropic のこれまでで最速のモデルであるため、同社はライブ カスタマー サポートやブラウザの使用など、遅延に敏感なアプリケーションにこれを推奨しています。脚注の 1 つでは、Anthropic の Opus モデルは依然として高速モードで高速に実行されるという注意事項を追加しています。

価格: Haiku 4.5 より最大 90% 安い

見出しの変化は価格です。 Anthropic によれば、Haiku 5.5 は、プロンプトのサイズに応じた階層構造により、Haiku 4.5 よりも実行コストが平均で約 75% 削減されています。

最大 100,000 トークンのプロンプトを伴うリクエスト (Anthropic によれば、これが以前の Haiku モデルへのリクエストの約 90% を占めていた) の場合、価格は Haiku 4.5 より 90% 低くなります。 100,000 トークンを超えるプロンプトのコストは 50% 削減されます。

Anthropic の発表による 100 万トークンあたりの価格表は、値下げの規模を示しています。

  • 入力トークン: $0.10 (100,000 までのプロンプト) または $0.50 (100,000 を超える)、Haiku 4.5 の一律 $1.00 から値下げ
  • 出力トークン: $0.50 または $2.50、$5.00 から値下げ
  • キャッシュ読み取り: $0.01 または $0.05、$0.10 から値下げ
  • キャッシュ書き込み: $0.125 または $0.625、$1.25 から値下げ

100,000 未満の層では、Haiku 5.5 の出力価格は Sonnet 5.5 の 100 万出力トークンあたり 10.00 ドルの 5 分の 1 になります。

Anthropic は、数字の裏にある技術的な詳細を 1 つ指摘しています。Haiku 5.5 は、Sonnet 5.5 や Opus 5.5 と同様に、更新されたトークナイザーを使用しています。つまり、Haiku 4.5 よりもタスクごとに使用するトークンがわずかに多くなります。同社によれば、平均コストの計算ではその差が考慮されるという。

ベンチマーク: ほとんどの行で GPT-6 Luna を上回っています

Anthropic は、Haiku 5.5 と Haiku 4.5、GPT-6 Luna、Sonnet 5.5 を比較したベンチマーク表を公開しました。リストされた評価のほとんどにおいて、新しいモデルは Luna よりも早く、前モデルよりも劇的に早く終了しました。

  • GDPval-AA v2.1 (ナレッジ ワーク): Haiku 5.5 では 1620、Haiku 4.5 では 735、GPT-6 Luna では 1437、Sonnet 5.5 では 1840
  • AA-ブリーフケース v1.1: 1578、対 Haiku 4.5 では 614、Luna では 1336
  • OSWorld 2.1、オフライン サブセット (コンピューター使用): 72.4%、対 Haiku 4.5 では 15.7%、Luna では 48.9%、Sonnet 5.5 では 83.9%
  • 人類最後の試験: ツールなしの場合は 45.9%、ツールありの場合は 57.4% でしたが、Haiku 4.5 では 10.2% と 18.7% でした。
  • ターミナルベンチ 4.0 (エージェント コーディング): 39.2%、Luna では 16.4%、Sonnet 5.5 では 70.6%
  • FrontierCode 1.1、メイン: 46.4%、Luna の 42.4% を上回る

このパターンは一貫しています。Haiku 5.5 は GPT-6 Luna との差の多くを縮め、コンピューターの使用においては完全にそれを上回りますが、Anthropic 独自の Sonnet 5.5 は依然としてすべてのカテゴリーでリードしています。 Anthropic のガイダンスはその階層構造を反映しており、同社によれば、Sonnet 5.5 と Opus 5.5 は「ターミナルベンチ 4.0 で測定されるような複雑なエージェント コーディング タスクには依然として優れた選択肢である」一方、Haiku 5.5 は「以前のバージョンの Claude では法外なコストがかかっていた可能性がある」狭い範囲の作業を対象としています。

エフォートダイヤルを使った初めての俳句

Haiku 5.5 は、以前より大きなモデルで提供されていたコスト対インテリジェンスの制御 Anthropic である調整可能な努力設定を搭載した最初の Haiku クラスのモデルでもあります。ユーザーは各リクエストが消費するコンピューティングの量を選択でき、Anthropic のグラフには低から最大までの各努力レベルでのベンチマーク スコアが表示されます。

安全姿勢: Haiku 4.5 よりきつく、ソネットよりゆるい

安全性について、Anthropic 氏は、Haiku 5.5 は「Haiku 4.5 と比較して、ほぼすべての整合性評価において大幅な改善」が見られ、不正な動作の例がはるかに少なく、誤用に協力する意欲が低いと述べています。

このモデルのサイバーセキュリティ保護手段は Haiku 4.5 よりも制限的ですが、Anthropic の最近のより大きなモデルに比べて制限は若干緩くなっています。 Sonnet 5.5 のセーフガードよりも広範囲の防御セキュリティ タスクが許可されますが、依然として侵入テストや攻撃者が使用する可能性の高い手法はブロックされます。生物学の保護措置は、Sonnet 5、Sonnet 5.5、および Opus 5 の保護措置と一致します。より広範なアクセスが必要な組織は、Anthropic のライフ サイエンス プログラムまたはサイバー検証プログラムに適用できます。詳細については、Haiku 5.5 システム カードを参照してください。

残りのお知らせ: より安価なソネット、無料の API クレジット

このリリースには、他のいくつかの変更がパッケージ化されています。 Claude Sonnet 5.5 でのキャッシュ読み取りのコストは、100 万トークンあたり 0.20 ドルではなく 0.10 ドルになりました。Anthropic によれば、50% 削減により、ほとんどのエージェント作業で Sonnet 5.5 は約 20% 安くなります。これは、キャッシュ読み取りがエージェント ワークフローのトークン消費の大半を占めるためです。

Anthropic は今週、サブスクリプション顧客向けに月次 API クレジットも展開します。最大 5 倍のユーザーには月額 100 ドル、最大 20 倍のユーザーには月額 200 ドル、チーム プランではユーザー間で最大 500 ドルがプールされ、どのモデルでも使用できます。このクレジットは、Claude Platform 上でツールやエージェントを構築する加入者を対象としています。

開発者も SDK アップデートを入手できます。Anthropic の Python および TypeScript SDK はベータ版でコンピューターの使用とブラウザーの使用をサポートするようになり、同社によればその機能は Haiku 5.5 の速度と価格のプロファイルに適しているとのことです。

終わりの見えない価格戦争

Decoder の報道は、今回の発表を「AI の価格設定軍拡競争はまだ終わっていない」という証拠であると主張しており、数字はその見方を裏付けています。 9月、AnthropicとOpenAIは互いに数時間以内に競合するフラッグシップモデルを発売し、競合する値下げを行った。 Haiku 5.5 では、その戦いが市場のローエンドにまで拡大され、そこでは小型モデルが大容量で最も価格に敏感なワークロードを強化します。

開発者にとって、その即時的な影響は単純明快です。Claude プラットフォームでの小規模モデル推論は、入力トークン 100 万あたり 0.10 ドル、出力トークン 100 万あたり 0.50 ドルから始まり、その価格帯では、Anthropic が公開しているほとんどのベンチマークで GPT-6 Luna が上回っています。 OpenAIがLunaの値下げで応じるか、それとも次の小型モデルのリリースを待つかは、この価格の下限が実際にどれだけ耐久性があるかを示すことになる。

Haiku 5.5 は現在、Anthropic のファーストパーティ アプリと API、アマゾン ウェブ サービス、Google Cloud、Microsoft Foundry 全体で利用可能であり、すでに GitHub Copilot に統合されています。

AI の先を行く AI Buzz Wire で AI ニュースをもっと読む