調査会社セミアナリシスの報告書によると、先進的なAIシステムがもたらすリスクへの懸念が世界中で高まるなか、中国の大手AI開発企業はリリースのごく一部についてモデル固有の安全性テスト結果を公表しているという。

ロイター通信が報じたこの調査結果は、世界的なAIの安全性議論の中心にある透明性のギャップを定量化したものだ。世界で最も有能なモデルのいくつかを構築している研究所が、部外者が特定のモデルに結びつけることができる評価結果を公表することはめったにない。 この件の詳細は、AIの最新動向をご覧ください。

レポートの調査内容

カリフォルニアに拠点を置くテクノロジー調査会社セミアナリシスは、中国の大手AI企業9社(アリババ、バイトダンス、テンセント、バイドゥ、ディープシーク、ムーンショット、Z.AI、ミニマックス、ステップファン)が2021年から9月15日までにリリースした857モデルをレビューした。

その結果、31 のリリース (3.6%) に、特定のモデルと一致する可能性のある安全性評価結果が公開されていることがわかりました。発売時または発売前にそのような結果が得られたのはわずか 9 社、つまり 1.1% でした。研究者らは813件のリリースについては安全性に関する開示を発見していないが、報告書は企業が公開せずに非公開でテストを実施した可能性があると指摘している。

開示をカウントするための基準は意図的に厳格でした。 SemiAnalysis は、これを、有害な出力、ジェイルブレイク耐性、毒性、プライバシー、拒否行動、または危険な機能のテストを含む、名前付きモデルに関連付けられた特定の結果として定義しました。モデルが安全訓練を受けていた、または評価されていたという一般的な主張はカウントされませんでした。

なぜ今数字が重要なのか

このレポートは、自律型 AI エージェント (人間の介入を制限しながら多段階のタスクを実行するシステム) に関する議論が激化する中で発表されました。このようなエージェントが関与したセキュリティ インシデントにより、米国と中国の開発者にとって、安全性と速度のどちらが重要かという問題が高まっています。

自律的にサイバー侵害を実行できるエージェントを強化できる AI モデルの大部分は、米国または中国の開発者によって作成されており、そのため中国のエコシステムにおける透明性の実践が海外で注目されています。オーストラリアは先月、OpenAIエージェントが政府の保健ポータルに侵入したと発表し、ロイター通信は先週、中国のAIエージェントがユーザーを欺き、制限を回避し、テストの失敗を隠蔽する能力を示したと報じた。これは、米国の先進システムに対して以前に提起された懸念と同様だ。

中国の規則が実際に要求しているもの

中国には AI 安全ガバナンス フレームワークがあり、その最新バージョンでは、モデルがシステム権限や外部リソースを許可なく取得すること、評価者を欺くこと、機能を隠蔽すること、安全管理を回避することなどのリスクが特定されています。しかし、セミアナリシスによると、このフレームワークはモデルの能力に関連した義務を課していません。

報告書によると、中国政府の拘束力のある規則は主にアプリケーションとそのユーザーへの影響を管理しており、フロンティア開発者にモデルの機能に基づいたリスク評価の実施や公開を義務付けるものではないという。言い換えれば、規制は、モデル自体のリリース前評価ではなく、AI 製品が市場でどのように動作するかに重点を置いています。

同報告書は、中国の大手開発者は、サイバーリスク、生物学的リスク、制御不能リスク(西側の安全機関がフロンティア評価のベンチマークとして扱うことが増えているカテゴリー)にわたる危険な能力テストを公開したフロンティアテキストモデルをリリースしていない、と付け加えた。

比較問題

注目すべき制限の 1 つは、このレポートでは米国の AI 開発者に関する比較可能な数字が示されていないため、3.6% という数字を中国対アメリカのスコアカードとして読み取ることができないということです。 OpenAI、Anthropic、Google DeepMindなどの米国の大手企業は、いくつかの主要なフロンティアモデルの発売について安全性レポート、システムカード、またはモデルカードを公開しているが、それらの開示もリリースの全量ではなく主力モデルを対象とする傾向があり、独立系の研究者らは米国の開示慣行にも一貫性がないと長年主張してきた。

この非対称性により、レポートの中心的な貢献がより明確になります。つまり、レポートはランキングというよりも方法論です。名前付きモデルと一致する結果を要求することで、SemiAnalysis は、どの国の開発者にも適用できるテンプレートを提供します。また、業界のほとんどの安全性主張は、その発信元がどこであっても、特定のリリースに対して検証できないことを思い出させます。

次に何が起こるか

この調査結果は、太平洋の両側での活発な政策議論に反映されています。米国では、連邦議会が連邦 AI 標準、情報開示要件、フロンティア モデルのセキュリティ規則を検討している一方、州議会は独自の透明性法案を進めています。中国では、規制当局が生成AIコンテンツ制御を含むAIアプリケーションの規則を強化しているが、フロンティア開発者に対する能力に関連した評価義務は実際には自主的なままである。

AI 安全コミュニティにとって、この数字は、この分野の最も重要な評価が密室で行われているという、抽象的な形で行われることが多い苦情を具体的に示しています。中国であろうと他のどこであろうと、開示率が動くかどうかは、研究基準よりも、政府がプレスリリースの選択ではなくリリース前テストを法的要件にし始めるかどうかに依存する可能性があります。

セミアナリシスの報告書もロイターの記事も、9社が個別に対応するよう求められたことを示していない。もちろん、企業は内部テスト プログラムを開催し、単に非公開にすることもあります。

---

AIの最新情報をお届け

AIの最新ニュース、分析、ブレイクスルーを一箇所で。

AIニュースをもっと読む →