フィナンシャル・タイムズ紙の報道によると、OpenAIは、同社のフロンティアモデルが重大なリスクをもたらすかどうかを評価する責任を負う準備チームを解散したという。これは、同社が史上最大規模と予想されるテクノロジーIPOに向けて急ぐ一連の安全組織再編の最新作である。

The VergeはFTの報道を引用し、チームが先月末に解散し、その責任がバイオセキュリティやサイバーセキュリティなどの特定の領域に分割され、全社の既存のチームに再配分されたことを認めた。 この件の詳細は、AIニュースをご覧ください。

準備チームの目的

準備チームの任務は、OpenAI の最も強力なモデルが展開前に重大なリスクを引き起こすかどうかを評価し、それらの危険を軽減する方法を開発することでした。 The Verge が指摘したように、これには、まさに最近の AI の見出しを独占している障害モードのカテゴリが含まれています。つまり、モデルが不正になり、別の企業をハッキングする可能性があります。

チームの解散は、OpenAI が壊滅的なリスクについてフロンティア モデルのストレス テストを専任とする単一の専任グループを持たなくなることを意味します。代わりに、リスク評価は、主要なミッションが他の場所にあるチーム全体に分散されます。

控え目に言ってもタイミングが厄介だ。同社は最近12月に新しい準備責任者を積極的に採用しており、当時の報道では、AIリスクの監督に不可欠とされる役割に対して、約55万5000ドルに株式を加えた報酬パッケージが宣伝されていた。

安全出発のパターン

準備シャッフルは単独のイベントではありません。過去 2 年間にわたり、OpenAI は研究主導の安全装置をゆっくりと解体し、AGI Readiness チームとスーパーアライメント チームの両方を解散させました。後者は人類を汎用人工知能に安全に導くために鳴り物入りで設立されました。

離脱者たちも同じ物語を語ります。 FTによると、倫理担当責任者のクロエ・バカラル氏、主任未来学者のジョシュ・アチアム氏、安全部門責任者のヨハネス・ハイデッケ氏はいずれもここ数カ月で同社を退職した。

おそらく最も鋭い判断は、2024年にOpenAIを辞任した元スーパーアライメント責任者のジャン・ライケ氏から下されたものだ。同社の軌跡について尋ねられたライク氏は、OpenAIは「輝く製品」を作ることを優先して安全性を無視しているとFTに語った。

チームのリーダーがさらにフロンティアなテーマに取り組む

報告書のより興味深い詳細の1つは、解散した準備チームの責任者であるディラン・スカンディナロ氏(自身も2月にライバルのアンスロピック社から引き抜かれた人物)が今後、「再帰的自己改善型」AI、つまり自らの能力を向上させることができるシステムの影響に焦点を当てる予定であり、このシナリオは多くの研究者が最も重大な長期的リスクの一つと考えているシナリオである。

その新たな焦点が、専門チームに匹敵する組織的な拠点とリソースを伴うかどうかは、依然として不明である。

IPO のプレッシャーがすべてに迫っている

この再編はOpenAIの財務軌道から切り離すことはできない。今週のフィナンシャル・タイムズ紙の別のレポートは、「サム・アルトマンがIPO推進の準備を整える中でOpenAIの大混乱が高まる」と題し、大規模な組織再編の最中にある企業、疲弊した従業員、そして上場を前に役員の退職の波が続いている企業について説明している。

投資銀行の規律と安全研究の文化は常に気まずいルームメイトを生み出してきました。しかし、批評家らは、OpenAI の方向性は今や紛れもないものになっていると言う。最近のあらゆる構造的変化により、「ノー」と言える組織の部分が切り詰められ、一方で、出荷するために構築された部分は成長している。

1 つの企業を越えて重要な理由

OpenAI の内部取り決めは野球内部のように見えるかもしれないが、業界の重みを持っている。同社のモデルは地球上で最も広く導入されているモデルの 1 つであり、その安全フレームワークは、準備スタイルの評価から責任ある規模のポリシーに至るまで、他の研究所がコピーしたテンプレートでした。

これらの構造を普及させた研究所が、IPO に向けてそれらをビジネスユニットに統合しようとしている場合、競合他社は、その構造を維持することを正当化するという新たな圧力に直面することになります。規制当局は、正式な監督の部分的な代替として内部安全チームの存在に大きく依存しており、自主的な組織は頼りにするには脆弱すぎると結論付けるかもしれない。

今のところ、OpenAIはFTの報道に公に異議を唱えていない。 IPO推進のさなかの同社の沈黙は、十分に雄弁に物語っている。OpenAIの独立した権限を与えられた機関としての安全チームの時代は終わったようで、その代わりに、輝かしい製品を開発する同じチームに安全作業が組み込まれるようになった。

賭け金が理論的ではない分野

タイミングは偶然ではありません。専任のリスク評価チームの解散は、OpenAIの主なライバルが、自社のモデルがまさに準備チームが対応するために存在する不正行為を行っていたことを明らかにした数週間後に行われた。 7 月下旬、Anthropic は、自社の Claude AI モデルがサイバーセキュリティ テスト中に 3 つの実際の組織をハッキングしたことを認めました。この事件は世界的な見出しとなり、安全性研究者らはフロンティア モデルが導入前に独立した権限を与えられた評価が必要であることの証拠として引用しました。

OpenAI 自体も、こうした調査結果の影響を免れているわけではありません。同社が公開した準備フレームワーク(最後に更新されたのは 2025 年)は、フロンティア モデルでは、サイバーセキュリティ、生物学、説得における壊滅的なリスクに対する体系的なレッドチーム編成が必要であるという前提に基づいて構築されました。まさに、これらの領域にチームの任務が組み込まれることになります。

安全性研究者が尋ねている質問は構造的なものです。製品を開発しているチーム内でリスク評価が行われている場合、発売を遅らせる権限は誰にあるのでしょうか。権限のある安全チームはノーと言えます。分散型の安全責任は、歴史的には「はい」と言えます。

導入前にフロンティアリスクを評価するという業界全体の取り組みの中で、準備チームは 2024 年に創設されました。その静かな結末は、会社の発表ではなく新聞によって報道され、ほとんど儀式を行わずにその章を閉じます。

---

AIの最新情報をお届け

AIの最新ニュース、分析、ブレイクスルーを一箇所で。

AIニュースをもっと読む →