Anthropic は、Claude モデルによって生成されたテキストに目に見えない透かしの適用を開始することを今週確認し、欧州の新しい透明性規則に対応して機械可読の出所信号を追加する最新の AI プロバイダーとなることを明らかにしました。
更新されたサポート ページで詳しく説明されているこの変更は、Claude によって作成されたコンテンツが、他の場所にコピー アンド ペーストされても耐えられるように設計された隠し署名を保持することを意味します。これは、8 月 2 日に発効し、他のシステムが検出できる方法で生成または編集されたコンテンツをマークすることを AI 企業に義務付ける欧州連合の AI 法の透明性規定への直接の対応です。
ウォーターマークの仕組み
アンスロピック氏によると、8月2日以降に発売されるすべてのモデルには、コンピューターで生成されたテキストとファイルの両方に透かしを入れる技術が自動的に組み込まれるという。ファイルに関して同社は、メディアの作成方法を記録するために一部のカメラ メーカーや画像編集ツールですでに使用されているコンテンツ認証フレームワークである C2PA オープン スタンダードを採用しています。
テキストの透かしは、後付けとして適用されるのではなく、モデル レベルで埋め込まれます。 Anthropic のサポート ドキュメントによると、「透かしはテキストの一部であるため、コピーして別の場所に貼り付けるときにテキストと一緒に移動し、編集によっても残る可能性があります。透かしはモデル レベルで適用されます。つまり、テキストがどのクロード製品または表面から来たものであっても、透かしは存在します。」
同社は、ウォーターマークのサポートを古いモデルにも拡張する予定であると付け加えた。この機能は、Claude プラットフォーム API、Claude チャット アプリ、Claude Code、Claude Cowork、Claude Tag など、Anthropic の製品ライン全体に適用されます。
マークを剥奪するためにユーザーがどの程度の編集を行う必要があるのかは完全には明らかではなく、Anthropic はその手法について詳しく公表していません。テキストの透かしは技術的に困難です。文言を少し変更すると、この分野の研究者にとって長年の課題である脆弱な統計パターンが崩れる可能性があるからです。
ユーザーのオプトアウトなし
特に、Claude ユーザーはウォーターマークを無効にすることができません。この設定は、リクエストごとに切り替えるのではなく、モデル自体によって強制されます。つまり、クロード サーフェスを通じてテキストを生成する人は誰でも、望むか望まないかにかかわらず、そのテキストにマークが付けられることになります。
こうした姿勢は一部のプロユーザーからの反発を招きそうだ。 Claude を使用してコンテンツの下書きを行うライター、開発者、および企業は、クリーンでマークのない出力に慣れており、インターネット上のテキストに目に見えない署名が続くことに不快感を感じる人もいるかもしれません。 Anthropic は、規制順守がその優先事項を上回ると結論付けたようです。
広範な業界の争奪戦の一環
人間は単独で行動しているわけではありません。 EUの透明性要件により、規制当局が介入する前に出所シグナルを追加するというAIおよびコンテンツプラットフォーム間の競争が始まっている。
つい先週、AI音楽プラットフォームのSunoは、AI生成オーディオをめぐる法的異議申し立ての波を受けて、同社のサービス上で作成されたトラックのマークを開始すると発表した。先月、ニュースレタープラットフォームのSubstackは、検出会社Pangramと提携してAI生成コンテンツに警告を発し、Substackの最高経営責任者(CEO)クリス・ベスト氏は「クロードフィッシング」(AIを利用してプラットフォームに低品質の素材を大量に送り込む人たちを指す彼の用語)を公に批判した。
この圧力は、Anthropic の直接の競合他社をはるかに超えて広がっています。 TechCrunchの報道によると、Black Forest Labs、Google、Meta、Microsoft、OpenAI、SynthesiaはいずれもEUの透明性規定を遵守することに尽力しており、透かし入れが差別化要因ではなく、急速に業界の基本的な期待になりつつあることを示しているという。
なぜ出所が急に必要になったのか
ウォーターマークの推進は、2 つの収束する不安を反映しています。 1 つ目は規制です。現在 EU AI 法が施行されており、遵守しない企業は重大な罰則を受ける可能性があります。出所インフラストラクチャを早期に整備することは、強制的な圧力の下でインフラストラクチャを改修するよりも安価です。
2つ目は評判です。 AIが生成したテキスト、画像、音声、ビデオがソーシャルプラットフォームに氾濫する中、パブリッシャーやプラットフォームは、人間の仕事を排除し信頼を損なう低品質の合成コンテンツである「AIスロップ」に対する反発の増大に直面している。目に見えない透かしは、モデレーションだけでは解決できない質問、つまりこれは機械によって書かれたのか? に対する技術的な答えを提供します。
AI の安全性を中心にブランドを構築してきた Anthropic にとって、ウォーターマークの採用は信頼性を高める取り組みでもあります。自らを責任ある代替手段として売り出す企業には、足を引っ張られると思われるよりも、透明性をリードするという強いインセンティブがある。
さらに難しい問題は未解決のままです。ウォーターマークは、検出ツールが実際にウォーターマークを検索し、コンテンツがオープン Web 上で移動するときに発生する編集、再フォーマット、ロンダリングに耐えられるほど堅牢であることが証明された場合にのみ役に立ちます。 Anthropic 氏は、信号をモデル レベルで埋め込むことが最も耐久性のあるアプローチであると考えています。それが実際に通用するかどうかは、今後数カ月以内に迅速かつ公にテストされることになる。
AI 政策と業界を再構築するツールに関する継続的な報道については、AI Buzz Wire の最新 AI ニュース報道 をブックマークしてください。
