Googleは水曜日、Gemini 3.8 Flashを、Gemini 3.8 Flash Cyber​​と呼ばれるサイバーセキュリティに焦点を当てた新しい亜種とともにリリースし、これが6週間で3回目のFlashモデルの発売となる。 Googleの公式ブログで公開されたこの発表は、同社がリリースを準備しているとの報道から数日後に行われたもので、この低予算モデルをトークンあたり数倍のコストがかかるライバルに匹敵するベンチマークの主張も伴っている。

速いリズムは物語の中の物語です。 Google は約 3 週間前に Gemini 3.7 Flash を出荷し、現在は 3.8 Flash が同社のデフォルトの主力モデルとして置き換えられています。一方、Googleは2026年初頭以降、フロンティアレベルのGemini Proモデルをリリースしておらず、長年約束されていたGemini 3.5 Proも依然として目立って存在しない。このストーリーの詳細については、最新の AI 開発 の報道をご覧ください。

2 つのモデル、1 つの基礎

Gemini 3.8 Flash には 2 つのバージョンがあります。標準モデルは、エージェント タスク、ソフトウェア開発、および大容量アプリケーション向けの汎用推論およびコーディング システムとして位置付けられています。 Gemini 3.8 Flash Cyber​​ は同じ基盤上で実行されますが、以前の 3.5 Flash Cyber​​ に代わるものとして、脆弱性の検出と緩和のために特別に調整されています。

Google が公開した数値によると、Gemini 3.8 Flash は、長期的なソフトウェア エンジニアリング タスクを測定するベンチマークである DeepSWE v1.1 で 73.7% のスコアを獲得しています。これは、Claude Opus 5 の 74.0 パーセントをわずかに下回っており、OpenAI の GPT-5.6 Sol の 72.7 パーセントや Claude Sonnet 5 の 53.8 パーセントを上回っています。以前の Gemini 3.7 Flash は、同じベンチマークで 65.3% のスコアを記録しました。これは、このリリースの利益の大部分がコーディングに集中していることを意味します。

独立したベンチマーク プラットフォームである Artificial Analysis は、新しいモデルのインテリジェンス インデックス スコアが 59 で、前モデルの 56 を 3 ポイント上回っています。プラットフォームのデータによると、これは、推論努力が高い場合は GPT-5.6 Sol、推論が中程度の場合は Grok 4.6 と同等であり、その向上は主にツールの使用やコーディングなどのエージェント ベンチマークによってもたらされます。

魅力的な価格設定

Google はこのモデルを、入力トークン 100 万あたり 0.75 ドル、出力トークン 100 万あたり 3.75 ドルの導入料金で開始します。これは、年末までの 3.7 Flash の価格と同じです。 2027 年 1 月から、通常価格はそれぞれ 2 倍の 1.50 ドルと 7.50 ドルになります。ライバルとの比較は依然として厳しいままです。Claude Opus 5 の価格は 100 万入力トークンあたり 5.00 ドル、出力トークン 100 万あたり 25.00 ドルですが、GPT-5.6 Sol は 4.00 ドルと 20.00 ドルです。

コストを重視するチームにとって、注目に値する落とし穴があります。 Googleは、パフォーマンスの上昇の一部は、複雑なタスクに対して追加の推論ステップを実行し、ツールを繰り返し呼び出すモデルによるものだと考えている。同社の言葉を借りれば、モデルは「より激しく動作する」ということだ。これはトークンの消費量の増加につながります。 Artificial Analysis では、トークンあたりの価格は変わらないものの、完了したタスクあたりのコストは 0.58 ドルに設定されており、3.7 Flash の 0.40 ドルから約 40% 増加しています。 Google 自体は、コンピューティング予算が厳しい開発者に対して、推論レベルを下げるか、引き続きサポートされている 3.7 Flash を使用し続けることを推奨しています。

Flash Cyber はセキュリティ操作をターゲットにしています

Cyber バージョンは、リリースのより珍しい半分です。 Google によると、内部テストでは、Gemini 3.8 Flash Cyber​​ が以前のバージョンよりも多くの脆弱性を特定し、実用的なパッチをより頻繁に作成していることが示されました。 Google の Chrome セキュリティ チームは、内部使用中にパッチの精度が 2.6 倍向上したと報告しており、同社のクラウド チームはこのモデルを使用して 2 時間以内に重大な脆弱性を明らかにしたと述べています。 GoogleはセキュリティパートナーのWizとPalo Alto Networksの証言も引用した。

ただし、アクセスは制限されています。標準の 3.8 Flash は今日から広く利用可能になりますが、Flash Cyber​​ は今のところ信頼できるテスターと政府に限定されています。

欠けているフロンティアモデルの質問

この発表により、Googleのリリース戦略は不快なスポットライトを浴びることになる。 Ars Technica は、Google が 2026 年初頭以来最前層の Gemini Pro モデルを出荷していないことを指摘し、今年初めの報道では、コーディング パフォーマンスが競合他社に匹敵しなかったため、Gemini 3.5 Pro のリリースが延期されたことが示されています。デコーダーの打ち上げに関する報道では、フラッシュの速いリズムを、誰に尋ねるかに応じて、エンジニアリングの勢いの兆候か、まだ行方不明の旗艦からの気晴らしのいずれかであると枠組み付けしました。

Google DeepMindの責任者に就任したKoray Kavukcuoglu氏は、発表資料の枠組みを否定し、Googleは価格性能だけを追求しているわけではなく、依然として本来の能力でリードするつもりであると述べた。ベンチマークの数値が Google 自身の評価を超えて通用するのであれば、同社は時間を稼いだ可能性がある。同社の低予算 Flash 層ですら、今や企業が現在最も重視している機能であるコーディングにおいて市場リーダーと競合している。

すべてが改善されたわけではありません。 Google 独自のグラフによると、エージェントによるコンピュータ使用のベンチマークである OSWorld-2.0 では、3.8 Flash は以前のバージョンよりも優れていますが、依然としてクロード オーパスに大差をつけられています。

可用性

Gemini 3.8 Flash は、Google AI Studio、Antigravity エージェントティック コーディング ツール、および開発者向け Android Studio を通じてすぐに利用可能であり、企業は Gemini Enterprise 経由でアクセスできます。消費者は、Pro または Ultra のサブスクリプションが必要な Gemini アプリで、Google 検索の AI モードで、また有料購読者の場合は Google Sheets 内でこの機能を使用できます。 AI Studio を通じて無料の実験が引き続き可能です。

Googleはまた、モデルの3D生成の改良点も強調し、伝えられるところによれば、同社のNano Banana画像モデルによって生成されたテクスチャを使用して、Antigravityの単一プロンプトから構築された3Dゲームを示した。

競争力の計算は簡単です。現在、3 つの主要なラボが互いに数週間以内にトップレベルのコーディング モデルを出荷しており、Google の参入により、同等のコーディング パフォーマンスを主張しながら、価格で競合他社を 5 ~ 7 分の 1 に引き下げることができます。実際の開発者のエクスペリエンスがベンチマークと一致するかどうかによって、このリリースが Google の旗艦の不在に対する批判を静めるか、単に延期するかが決まります。

---

AI の先を行く

最新の AI ニュース、分析、画期的な情報をすべて 1 か所で入手できます。

AI ニュースをもっと読む→