Google DeepMind は、2026 年 7 月 21 日に 3 つの新しい Gemini モデルをリリースし、大規模な AI エージェントを構築する開発者向けのラインナップを強化しました。同社は、Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、および Gemini 3.5 Flash Cyber と呼ばれる特殊なサイバーセキュリティ モデルを出荷しました。しかし、この発表は、ほとんどの観察者が待ち望んでいたアップデート、つまり Google の主力商品である Gemini Pro の次期バージョンを伴わずに行われました。 AI ニュース速報 とフロンティア モデル レースの分析の詳細については、以下のストーリーで、何が出荷され、何が失敗し、それがなぜ重要なのかが詳しく説明されています。
効率性とエージェントをターゲットとした 3 つの新しいフラッシュ モデル
Gemini 3.6 Flash は Google の「主力モデル」として位置付けられており、以前のバージョンと比較してトークンの使用量を最大 17% 削減しながら、コーディング、ナレッジ ワーク、マルチモーダル パフォーマンスを向上させるように設計されています。 TechCrunch によると、このモデルは Gemini 3.5 フラッシュよりも安価でありながら、運用ワークロード全体でより強力な結果を提供します。
The-decoder は、以前の Flash モデルと比べて具体的なベンチマークの向上を報告しました。 DeepSWE は 37 パーセントから 49 パーセントに上昇し、MLE ベンチは 49.7 パーセントから 63.9 パーセントに上昇し、OSWorld-Verified エージェント ベンチマークは 78.4 パーセントから 83 パーセントに向上しました。 Google は、3.6 Flash の価格を入力トークン 100 万あたり 1.50 ドル、出力トークン 100 万あたり 7.50 ドルとしました。
Flash-Lite が最低価格を押し下げる
Gemini 3.5 Flash-Lite は、クラスで最もコスト効率の高いモデルで、低遅延と高スループットを実現するように調整されています。独立した評価機関である Artificial Analysis は、1 秒あたり 350 個の出力トークンを生成すると測定しました。デコーダーによると、入力トークン 100 万あたり 0.30 ドル、出力トークン 100 万あたり 2.50 ドルの費用がかかります。 Google によれば、Flash-Lite はいくつかのエージェントベンチマークとコーディングベンチマークで古い 3 Flash を上回っています。
Flash Cyber: 脆弱性を探索するために構築されたモデル
Gemini 3.5 Flash Cyber は、サイバーセキュリティの脆弱性を発見して修正できるように微調整されています。 Google は、これをコード セキュリティ エージェントである CodeMender に統合しました。 CyberGym ベンチマークでは、はるかに小型のモデルにもかかわらず、Flash Cyber のスコアは 83.2 パーセントで、OpenAI の GPT-5.5-Cyber の 85.6 パーセントに 2 ポイント以内でした。
Google の Big Sleep チームは、Chrome と Safari の重大な欠陥を探すために Flash Cyber を導入しました。 V8 JavaScript エンジンでコミットをスキャンすると、標準の 3.5 Flash では 47 件、Anthropic の Claude Opus 4.6 では 36 件と比較して、確認された固有の検出結果は 55 件見つかりました。別のテストでは、Google のクラウド脆弱性調査チームがこのモデルを使用してパブリック API をスキャンし、2 時間以内にリモート コード実行の欠陥を発見し、実用的なエクスプロイトを生成しました。
このモデルは防御だけでなく攻撃にも効果があるため、Googleはアクセスを制限している。 Flash Cyber は、限定的なパイロット プログラムを通じて、政府および信頼できるパートナーのみが利用できます。
Gemini 3.5 Pro はどこにありますか?
発売から目立って欠落しているのは、複雑な推論とコーディングのための Google の主力モデルである Gemini 3.5 Pro で、最後に更新されたのは 2 月です。 5月、GoogleはGemini 3.5 Flashと合わせてProリリースをからかい、「すでに社内で使用されており、来月の公開を楽しみにしている」と述べた。
そのタイムラインはずれてしまった。ブルームバーグは、Googleが自社のパフォーマンス目標を達成するのに苦戦しているため、3.5 Proのリリースが社内で遅れていると報じた。 Google DeepMindの製品責任者であるLogan Kilpatrick氏は7月21日、同社がパートナーとともに3.5 Proをテストしており、「すぐにリリースしたい」と述べたが、明確な日付は明らかにしなかった。
ライバルは待ってくれない
競争力の差は拡大している。 TechCrunch は、Google が最後に Pro をアップデートして以来、OpenAI は GPT-5.5 をリリースし、GPT-5.6 の展開を開始し、一方、Anthropic は Claude Opus 4.8、Claude Sonnet 5 をリリースし、同社のフロンティア Fable 5 モデルへのアクセスを拡大したと指摘しています。中国の研究所も同様に接近しており、デコーダは、最先端の性能に近づいているシステムとして、Moonshot の Kim K3 と Zhipu の GLM-5.2 を指摘しています。
ジェミニ 4 のトレーニングが進行中です
キルパトリック氏はまた、チームがジェミニ4号に向けてこれまでで最も野心的な事前トレーニングを開始したことも明らかにした。デコーダーはこの開示をダメージコントロールと特徴付け、グーグルが市場の期待を理解しているものの、まだ主力製品を提供できていないことを示していると指摘した。
Google は、より広範なプラットフォームに新しい機能を追加しました。 Computer Use は Gemini API および Gemini Enterprise に組み込まれたクライアント側ツールとなり、モデルがブラウザーやデスクトップを操作できるようになります。同社はまた、化学的、生物学的、放射線、核、サイバーの脅威に対するより強力なフロンティア安全保護措置を追加しました。
これが開発者にとって何を意味するか
ビルダーにとって、新しいフラッシュ モデルは、速度、価格、機能の実用的な組み合わせを提供します。 100 万トークンのコンテキスト ウィンドウ、実際の利益を示すエージェント ベンチマーク、および積極的なトークン価格設定により、3.6 Flash および Flash-Lite は運用環境での導入にとって魅力的なものとなっています。一方、サイバーセキュリティ モデルは、一か八かのニッチ市場への注目すべき取り組みを表しています。
未解決の問題は、Google が主力製品がテスト段階にある間に、有能な中間層モデルを出荷する戦略をどれくらい維持できるかということだ。競合他社が安定したペースでフロンティア システムをリリースしているため、Gemini 3.5 Pro とその背後で実行される Gemini 4 のトレーニングに対するプレッシャーは高まるばかりです。
AI の先を行く
フロンティアモデル競争は急速に進んでいます。 AI Buzz Wire をブックマークすると、モデルの発売、ベンチマーク、業界の変化に関する毎日の報道がご覧いただけます。
AIニュースをもっと読む→

