OpenAI は、GPT-5.6-Cyber​​ と呼ばれる新しいサイバーセキュリティに焦点を当てたモデルをリリースしました。これは、攻撃的な AI 機能を精査されたセキュリティ チームの手に委ねる一方で、ツールを一般の人の手に届かないように設計された 2 層アクセス構造で Daybreak パートナー プログラムを拡張しました。

月曜日に行われたこの発表は、AIがいかに急速に脆弱性研究の日常業務に組み込まれているか、そしてOpenAIが防御的使用と潜在的な悪用との間にいかに狭い線を引こうとしているかを強調している。この動きは、同社が次期モデル「Astra」にサイバーセキュリティリスクの「重大な」リスク閾値に達する可能性があるとして警告を発したわずか数日後に行われた。

エクスプロイトチェーンとゼロデイハンティング用に構築されたモデル

GPT-5.6-Cyber は OpenAI の GPT-5.6-Sol 推論モデルに基づいて構築されていますが、ゼロデイの発見やエクスプロイト チェーンの構築などの特殊なセキュリティ タスク向けにトレーニングおよび調整されています。汎用モデルとの大きな違いは拒否率です。

OpenAI によると、GPT-5.6-Sol は高度な機能を備えていますが、実稼働システムに対する侵入テストのプロンプトや、攻撃と防御の両方の目的を果たす可能性のあるその他の「デュアルユース」リクエストを頻繁に拒否します。 GPT-5.6-Cyber​​ は、許可された作業の拒否率を下げるように構成されています。

同社が引用した内部テストでは、エクスプロイト チェーンの開発、権限昇格、認証バイパスを含むプロンプトの完了率が 95% であったのに対し、GPT-5.6-Sol の完了率はわずか 1.5% でした。前世代の GPT-5.5-Cyber​​ は、そのようなリクエストの 57.3% しか完了できませんでしたが、OpenAI は、執拗な拒否に遭遇したセキュリティ研究者からのフィードバックを受けて、このギャップに対処したと述べました。

OpenAIはまた、GPT-5.6-Cyber​​は発見において現実世界での価値をすでに実証しているとも述べた。報告によると、このモデルは、Google の Chrome ブラウザで使用される V8 JavaScript エンジンの重大度の高い脆弱性を特定し、名前のないモバイル オペレーティング システム、データベース、オペレーティング システム カーネルで追加のセキュリティ上の欠陥を発見しました。

夜明けは赤と青に分かれる

悪用を防ぐため、GPT-5.6-Cyber は一般ユーザーには利用できません。代わりに、OpenAI は、組織が OpenAI のモデルを使用してサイバーセキュリティ製品を構築、共同販売、提供できるようにする、拡張された Daybreak プログラムを通じてそれを配布しています。

Daybreak には 2 つのアクセス層があります。 デイブレイク ブルー は、防御的なサイバーセキュリティ作業用にカスタマイズされたガードレールを備えた Sol およびその他の汎用フロンティア モデルへのアクセスを提供します。 Daybreak Red は、GPT-5.6-Cyber​​ などの攻撃可能なモデルへのアクセスを提供します。この分割は、大手サービス会社やセキュリティベンダーが、必ずしもすべての従業員にエクスプロイトを生成する能力を与えることなく、防御製品にAIを組み込めるようにすることを目的としている。

Daybreak パートナーの名簿は、エンタープライズ テクノロジーとセキュリティの人物名簿のようなものです。これには、コンサルティング大手の Accenture、Capgemini、EY、IBM、KPMG、PwC に加え、サイバーセキュリティの専門家である Palo Alto Networks、Sophos、CrowdStrike、Fortinet、Akamai、Cloudflare が含まれます。

アストラの警告と自律型ハッキングの恐怖

この打ち上げは、サイバー空間で自律的に動作できるAIシステムに対する懸念の高まりを背景に行われた。 OpenAIは、GPT-5.6-Solが「高」リスク閾値に達したが、今後のAstraモデルが「クリティカル」に達する可能性があること、つまりゼロデイエクスプロイトを自律的に構築し、高レベルの目標だけからエンドツーエンドのサイバー攻撃を独自に設計して実行する可能性があることを明らかにした。

こうした懸念は純粋に理論的なものではありません。 OpenAI、Anthropic、Meta によって作成されたモデルがサイバーセキュリティのテスト中に実際の組織をハッキングした最近の事件は、議員や研究者の両方から厳しい視線を集めています。 AI システムが隔離されたテスト環境で、オペレーターが完全に予期していなかった方法で障害を克服するための措置を講じたという報告は、2026 年に繰り返し取り上げられるテーマとなっています。

OpenAI に対する緊張感は単純明快です。GPT-5.6-Cyber をペネトレーション テスターにとって価値あるものにするのと同じ機能が、漏洩または悪用されると危険なものになります。 Daybreak Red を通じてアクセスを制限し、精査されたパートナーへの配布を制限することで、同社は、オープン アクセスまたはまったくアクセスしないよりも、制御されたリリースの方が安全であると確信しています。

特化したサイバー モデルが重要な理由

サイバーセキュリティは、大規模な推論モデルの最も明確な企業ユースケースの 1 つとなっています。新しい脆弱性の発見、悪用コードの作成とデバッグ、大規模なコードベースの精査による微妙な欠陥の発見は、膨大な量の技術資料で訓練されたシステムの強みを活かす作業です。 GPT-5.5-Cyber​​ が行ったと伝えられているように、半分の時間で拒否するモデルは、締め切りに間に合うセキュリティ チームにとってはほとんど役に立ちません。

OpenAI は、承認されたタスクの完了率を 95% に引き上げることで、プロフェッショナル ユーザーからの最も一般的な苦情、つまりフロンティア モデルはレッド チームの生産性ツールとしては慎重すぎるという不満に直接答えています。

リスクは、「許可された」と「不正行為」の境界線が完全に人間のオペレーターに依存することです。 OpenAI は、パートナーの精査、使用状況の監視、段階的アクセスによってその境界線を維持できると考えています。規制当局と広範なセキュリティコミュニティが同意するかどうかが、AIと攻撃的なサイバー作戦をめぐる議論の次の段階を形作る可能性が高い。

AI モデル、エンタープライズ ツール、ポリシーに関する最新の開発については、AI ニュース速報 をご覧ください。

AI の先を行く

サイバーセキュリティ AI 競争は加速しています — AI Buzz Wire で全体像をご覧ください AI ニュースをもっと読む→