OpenAIは10月5日、欧州連合のユーザー向けにChatGPTとCodexによって生成されたテキストに目に見えない透かしを追加し始めると発表した。これはEU AI法のテキスト出所規則への具体的な対応である。同社は「EUのテキスト来歴ルールに対する当社のアプローチ」と題したブログ投稿で、域内の適格な作品に対して透かしを「今後数週間かけて」展開すると述べ、その計画はTechCrunch、The Verge、BleepingComputer、Engadgetなどの報道機関が同日報じた。
この変更の背後にあるテクノロジーは textGrain と呼ばれます。 textGrain は、目に見えるマークを埋め込むのではなく、モデルの単語の選択を微妙に操作することで機能し、結果として得られるテキストには、後で検出できる統計的パターンが含まれます。読者は、AI が生成したテキストを消費またはコピーしても何も気づきません。検出するには OpenAI の検出器にアクセスする必要がありますが、一般の人はこの検出器を利用できません。 AI ルールをめぐって規制当局と研究所がどのように衝突しているかをより詳しく知りたい場合は、当社が継続的に行っている AI ポリシーの報道に従ってください。
textGrain ウォーターマークの仕組み
OpenAI のアプローチでは、生成時のトークン選択プロセスが変更されます。 BleepingComputerの報道によると、同社はtextGrainが「モデルの単語の選択をわずかに変更して、後で検出できる統計パターンを作成する」と述べている。この透かしはテキストを読み取ったりコピーしたりするときには見えず、OpenAI は出力品質を低下させないと主張している。
検出側は意図的に制限されています。ウォーターマークの発表と並行して、OpenAI はウォーターマーク検出器のアプリケーションを公開していますが、アクセスは当初、承認された研究者と専門家組織に限定されます。この設計により、検出機能を武器化しようとする者の手に渡らないようになりますが、同時に、出版社、教師、雇用主がテキストに透かしが入っているかどうかを独自に検証できないことも意味します。
API アクセスは世界中でオプトインされています
EU の義務は、域内の ChatGPT および Codex 出力に適用されますが、OpenAI は同時に、あらゆる場所の開発者に選択肢を与えます。 10 月 5 日より、世界中の API 開発者は、サポートされているモデルのテキスト透かしをオプトインできるようになります。この機能は API ではデフォルトで無効のままであり、The New Stack は、今年初めに同じルールに対する独自の対応として EU トラフィックの来歴マーキングを有効にした Anthropic のアプローチとは対照的に、この決定を強調した。
このオプトインの姿勢は、予期せぬ副作用を心配する開発者を安心させるでしょう。統計的透かしはトークンのサンプリング方法を変更し、生成への変更には少なくとも理論上、エッジ ケースでの動作が変化するリスクが伴います。 OpenAI は、透かしをデフォルトではなくフラグにすることで、コンプライアンスの決定をそのモデルに基づいて構築している企業に移管します。
EU AI 法がこれを強制した理由
EU AI 法の透明性規定では、AI によって生成されたテキストが機械によって生成されたものであると識別可能であることが義務付けられており、これが OpenAI と Anthropic の両方に統計的透かし入れスキームを推進する義務となっています。 OpenAI のブログ投稿では、textGrain がこれらの出所要件の実装としてフレーム化されており、PYMNTS は、この展開を OpenAI が「EU AI 法の義務」に直接満たしていると報告しました。
タイミングが注目に値する。このウォーターマークの発表は、OpenAIの公的姿勢にとって異例の激動の最中に発表された。同じニュースサイクルが安全性リーダーのデビッド・ロビンソン氏の辞任、大手AI研究所における消費者リスクに関するFTCの調査、そして同社が常に監視下に置かれている株主訴訟の雰囲気をもたらした。ウォーターマークは、OpenAI が製品の変更ではなくインフラストラクチャで完全に満たせる数少ない規制要求の 1 つであり、これが OpenAI が最初に出荷された理由を説明している可能性があります。
キャッチ: 編集中にウォーターマークが壊れる
OpenAI 自体が根本的な制限があることを認めています。同社は、テキストが編集されると透かしが消える可能性があることを認めており、言語ステガノグラフィーに関する数十年の研究から、言い換え、翻訳、またはわずかな書き換えでさえも統計的な透かしが破壊される可能性があるという懸念が裏付けられています。 「ヒューマナイザー」ツールを通じて AI テキストをロンダリングしようと決心した人は、おそらく成功するでしょう。
この弱点があったとしても、規制当局はウォーターマークを要求することを止められず、研究所が透かしを出荷することも止められませんでした。現実的な目標は、出所を改ざんできないようにすることではなく、カジュアルな欺瞞のコストを大規模に引き上げることであり、これは通貨の透かしを管理するのと同じ論理です。業界の自主的な対策に懐疑的な一部のAI安全団体を含む批評家は、承認された組織のみがアクセスできる検出器は、独自のAIコンテンツポリシーを強制しようとする教師、編集者、プラットフォームにとってほとんど役に立たないと主張している。
ユーザーと開発者にとっての意味
EU 内の ChatGPT および Codex ユーザーの場合、目に見える変化はありません。テキストの見た目と感触は同じになり、出力にはラベルが表示されません。ウォーターマークは単にそこに存在し、原則として OpenAI の承認されたパートナーによって検出可能です。
開発者にとって、API フラグはすぐに届くため、慎重に評価する価値があります。API フラグをオンにすると、API 設定はグローバルであるため、EU 以外のユーザーであっても、完了するたびにトークン サンプリングに対する微妙な変更を受け入れることになります。レイテンシや品質の予算が厳しいチームは、スイッチを切り替える前に、現在のセットアップに対してウォーターマーク付きの生成をベンチマークすることをお勧めします。
OpenAIによると、対象となるモデルと検出器の申請プロセスに関する詳細は今後数週間以内に発表される予定だという。他の研究所も同様の EU 義務に直面しているため、textGrain が業界が今年展開する最後の透かしスキームになる可能性は低いです。
AI の一歩先を行く
規制により、AI 製品が内部でどのように動作するかが再構築されています。 AI Buzz Wire で最新の AI 開発を入手。政策分析とモデル ニュースが 1 日を通じて更新されます。
AI ニュースの詳細はこちら。