Google DeepMind は、汎用人工知能に関する議論を広げることに特化した新しい研究所を立ち上げました。その最初のエッセイには、フロンティア AI モデルを導入前に評価する米国主導の団体に対するデミス・ハサビスからの具体的な提案が含まれています。

TechCrunchによると、GoogleとGoogle DeepMindの研究者らによって水曜日に設立されたDeepMind Instituteは、DeepMindの共同創設者であるシェーン・レッグ氏を編集長に、Google幹部のジェームズ・マニカ氏とGoogle DeepMind会長のデミス・ハサビス氏を取締役に加えてリストアップしているという。 この件の詳細は、AIの最新動向をご覧ください。

異論の余地はある

同研究所が掲げる目的は、Google内部を含めた真の意見の相違を表面化することだ。 「彼らは常に同意するとは限らず、急速に変化するフロンティアでより多くのデータや情報が明らかになるにつれ、考えを変える可能性が高い」と発表には書かれている。

その最初のコレクションは、AGI の混乱の可能性を管理するための経済政策、人間が判読可能なモデル推論の維持、人類の繁栄のための原則、フロンティア AI モデルを評価するためのフレームワークをカバーする 4 つのエッセイで構成されています。

オープンな意見の相違を制度化することは、パブリックメッセージングが厳しく管理される傾向にある企業の AI ラボにとって異例の措置である。設計上、同研究所は、Googleの研究者に対し、同社の商業的利益と衝突する可能性のある立場、あるいは互いの商業的利益と衝突する可能性のある立場を議論する場を与えている。

透明性エッセイ: 「不透明なシリアルの深さ」をご覧ください

DeepMindの安全研究者であるロヒン・シャー氏とアンカ・ドラガン氏による4つのエッセイのうちの1つは、新しいアーキテクチャによって最も強力なモデルの監視が困難になっているにもかかわらず、AIの透明性の枠(モデルの段階的な推論を見て確認する能力)の縮小は避けられないと主張している。

著者らは、開発者と規制当局は安全性のトレードオフに直接向き合うべきだと主張する。具体的には、いわゆる「不透明なシリアル深さ」(可読な推論トレースを生成せずにモデルが実行できる逐次計算の量)を制限したり、透明性の低いシステムでも解釈可能なシステムと同様に監視可能であることを開発者に証明することを要求したりすることを意味する可能性があります。

この提案は、解釈可能性の喪失を規模の避けられない結果としてではなく、設計および政策の選択として扱い、規制に書き込むことができる要件への扉を開いたことで注目に値します。

Hassabis の提案: 米国フロンティア標準化団体

最も影響力のあるエッセイはハサビスのエッセイかもしれない。彼は、最先端の AI モデルの評価を任務とする米国主導のフロンティア AI 標準化団体を提案しています。この枠組みでは、開発者は当初、リリースの最大 30 日前までにレビューのために自主的にモデルを提出します。評価システムが効果的であることが証明されれば、そのテストに合格することが米国でフロンティアモデルを展開するための要件となる可能性がある。

同団体は、AI企業と協議して評価を設計することから始めるが、最終的には独立した非公開の評価(エッセイでは「ホールドアウト」テストと呼んでいる)を開発し、研究室が既知のベンチマーク(十分に文書化された公的評価制度の失敗モード)に合わせてモデルを調整することを防ぐことになるだろう。

ハサビス氏はまた、エスカレーションへの扉を開いたままにしており、フロンティアAI開発者間の協調的な減速を含む可能性として、枠組みは「状況の深刻さが必要に応じて段階的に強化される」可能性があると述べた。

他の 2 つのエッセイが重要な理由

残りの 2 つのエッセイは、AGI の混乱に対処するための経済政策と、人類の繁栄のための原則に関するもので、AGI を純粋に技術的な問題ではなく、社会全体の問題として扱うコレクションの締めくくりとなっています。経済的追放は長い間、高度な AI に関する最も具体的な国民の懸念であり、それを評価政策や解釈可能性と並べて考えることは、同研究所が政策立案者たちにこれらの部分を別々の議論ではなく 1 つの議題として捉えることを望んでいることを示唆しています。

この幅の広さは、Googleのポジショニングに関するシグナルでもある。同社は企業顧客や政府との契約をめぐって競争しているが、同時にフロンティアシステムには外部の監視が必要だと主張している。緊張を和らげるのではなく、その緊張を公表することが、同研究所の中核的な前提である。

懸念から具体的な提案へ

これらの論文は、業界の安全性に関する議論が広範な懸念表明から、開示要件、外部からの監視、そして(安全対策が遅れた場合には)協調的な減速といった特定のメカニズムへと移行する中で発表された。 TechCrunchによると、今週業界リーダーらがフロンティアAI開発の「ペース」を整えるというAnthropic CEOのダリオ・アモデイ氏の呼びかけの要素を支持したことで、その変化は加速した。

タイミングが重要です。大西洋の両側の政府は、評価インフラストラクチャよりも早く機能が進歩しているシステムをどのように監督するかを検討しています。主要な AI 研究機関内で発せられた提案は、政策立案者に、業界自体が名目上承認したテンプレートを提供します。これは、歴史的に有意義な AI 規制の前提条件でした。

何を見るべきか

同研究所の編集がグーグルから独立しているかどうかが最初の試練となる。透明性に関するエッセイがおそらくそうなっているように、エッセイに Google の商業ロードマップに反する立場が含まれ続ける場合、その会場は AGI ポリシーの議論に大きく貢献する可能性があります。それが企業向けメッセージングに移行すれば、ひしめき合う分野で PR チャネルが 1 つ増えることになります。

いずれにせよ、その内容は現在議論の対象となっており、リリース前の評価要件、テストの延期、さらには協調的な減速さえも、AI 分野で最も有力な人物の 1 人によって公に主張されている。問題はもはやフロンティアモデルを独立して評価すべきかどうかではなく、誰がどのようなスケジュールで評価を行うのかということである。

---

AIの最新情報をお届け

AIの最新ニュース、分析、ブレイクスルーを一箇所で。

AIニュースをもっと読む →