OpenAIは、10月6日にGitHub上で公開した722件の研究プレプリントのうち3件を撤回したと、Retraction Watchが10月8日に報じた。これは、署名ミスにより中心的な議論が無効になり、それに伴い、その構造に依存する2つの結果も無効になったためである。この撤回は、OpenAIが「人類の知識の最前線を押し広げ、数学のさらなる進歩を可能にする」取り組みとして宣伝していた大量リリースから24時間も経たないうちに行われた。
プレプリントには、幾何学、コンピューター サイエンス、代数、その他の分野にわたる 372 の未解決問題に関する内部 AI モデルによる進歩と称されるものが記載されています。この動きは直ちに研究コミュニティからの厳しい視線を集めた。そして、今週初めに722件の数学原稿の初期リリースに関するレポートで取り上げたように、同社はこの下落を、未公開のフロンティアモデルが生み出すことができるものの前例のないデモンストレーションであると位置づけた。この記事の最新情報については、最新の AI 開発 の記事をご覧ください。
署名エラーは依存する証明を通じて連鎖する
10月7日、OpenAIは署名ミスのため3件の原稿の取り下げを発表した。発表によると、この誤りにより、1 つの原稿の議論と 2 つの従属論文が使用した構造が無効になったという。現在、撤回された各文書には「ギャップ」を説明する通知が掲載されている。
同社はまた、証拠の修正、記述の修正、より明確な仮説と依存関係、および時代遅れの引用に対する1件の修正を加えて、他の14件の原稿を改訂したと述べた。 OpenAIの調査責任者であるDan Roberts氏は、Xに関する撤回を発表し、同社は「新たな形式化と、我々が気づいた誤りを含めてリポジトリを更新し続ける」と書いた。
OpenAIの広報担当者はRetraction Watchに対し、同社は監査中に誤りを特定し、そのプロセスは「他の研究論文と同様に」反復的であると述べた。広報担当者は、OpenAIは精査を歓迎し、「(間違いを)速やかに修正し、修正が見つからない場合は書類を撤回するよう努める」と付け加えた。
注目すべきは、OpenAIの広報担当者が、数学と人工知能に関する諮問グループ(AGMAI)の同社の協力者らが「完全な正式化」を待たずに結果を公開するよう推奨し、結果の約50%が未確認のまま公開されたと述べたことだ。
数学者: クイックフィックス、失われた信頼
研究数学者の反応は慎重ではあるが、鋭いものだった。コーネル大学の数学准教授アレックス・タウンゼント氏は、Retraction Watchに対し、3つの原稿に連鎖する誤りは驚くべきことではなく、さらに多くの誤りが見つかるのではないかと疑っていると語った。同氏は、数学の証明を機械的にチェックするオープンソースのプログラミング言語について言及し、「数学コミュニティにおけるAIへの懐疑を考えると、OpenAIはリーン検証された原稿を最初に発表すべきだったと思う」と述べた。その後、別の発表があれば、残りの部分を検証するためにコミュニティの協力を求めることができたかもしれない、と彼は主張した。
MIT数学科の主任研究員であるアンドリュー・サザーランド氏は、OpenAIがエラーを発見した後迅速に行動したことを高く評価し、「責任ある行動」だと述べた。しかし同氏は、多くの数学者が依然として「OpenAIのこれまでの振る舞いに不満」を抱いていることを強調し、特にAIシステムがナビエ・ストークス問題を解決したという同社の9月8日の発表を指摘し、この主張を有力な研究者グループが性急だと批判し、「適切な記事を書き上げたり、新しい手法やアイデアを分離したり、他の人の関連する過去の研究を引用したりする時間がない」と指摘した。 8,000 人以上の研究者がこうした懸念を支持しています。
人間数学協会は10月7日に発表した声明でさらに踏み込んで、「数学者はこの作業を行うよう求めたわけではない。700を超えるファイルを一度に公開することは学問の証明ではなく、権力の証明である。われわれは数学者に対し、OpenAIでの研究を中止し、人間の理解を中心とした科学のビジョンに戻ることを強く求める」と述べた。
AI が生み出す科学にとってこれが何を意味するか
このエピソードは、AI 研究所が機械生成の研究を大規模にどのように処理すべきかについての初期のテストケースとして形成されつつあります。 OpenAI のアプローチ — 迅速にリリースし、公開で監査し、失敗したものは撤回する — は、発表前に結果を Lean のような証明アシスタントでチェックする、多くの数学者が好む形式検証優先のアプローチとは対照的です。
どちらの側にも合理的な議論があります。完全な正式化を待っていると有用な結果が数か月遅れる可能性があり、OpenAIはAGMAIの祝福を受けてリリースしたと述べている。しかし、カスケード効果、つまり 1 つの符号ミスが 2 つの依存論文に影響を与えるということは、なぜ数学において出版前の検証が標準となっているのか、またコミュニティが残りの約 700 件の原稿に取り組むにつれてさらに多くの誤りが表面化する可能性が高い理由を示しています。
OpenAIは今のところ、フィードバックから学びたいと考えており、今後は「できる限り」AGMAIのプロトコルに従うつもりだと述べている。それが数学コミュニティの信頼性を再構築するのに十分であるかどうかは別の問題です。サザーランド氏は次のように述べている。「撤回と修正は数学界から好意的に受け止められると思うが、失った信頼を取り戻すにはそれ以上の時間がかかるだろう。」
---
AI の先を行く最新の AI ニュース、分析、画期的な情報をすべて 1 か所で入手できます。
AI ニュースをもっと読む→
