Anthropic がクロードのテキストと画像の出力に目に見えないウォーターマークを導入し始めてから数日後、この機能は批評家が予測していた通りの摩擦を引き起こしています。ユーザーは職場や授業で AI を使用する際にマークによって暴露されるのではないかと心配し、開発者は実際のコーディング ワークフロー内でウォーターマークがどのように動作するかを文書化し、小さいながらも目に見えるツールの市場はウォーターマークを取り除くことを約束しています。

Anthropic 氏は、この変更により、Claude は欧州連合の AI 法に沿ったものになると述べており、その透明性規則は 2026 年 8 月 2 日以降の新モデルに対して施行可能となった。同法の第 50 条では、AI システムプロバイダーに対し、機械生成された出力を「人工的に生成されたものとして検出可能」にするよう義務付けている。 Anthropic は、EU だけでなく世界中で提供されるすべての新モデルは「初日から」AI 生成コンテンツをマークし、以前にリリースされたモデルの更新には 2026 年 12 月までの猶予期間があることを確認しました。 この件の詳細は、AIの最新動向をご覧ください。

マーク自体は目に見えません。 Anthropic のサポート記事によると、テキスト出力には「透かしが埋め込まれています」が、生成されたファイルにはデジタル署名された来歴メタデータが含まれています (形式がサポートしている場合)。以前のクロード モデルもテキストをマークするように更新され、最終的にはフリート全体がその出力にスタンプを付けることになります。

ウォーターマークは生成されたテキストだけでなく、編集されたテキストもカバーします

技術的な好奇心を反発に変えた詳細が、8 月 13 日に Ars Technica によって明らかにされました。ウォーターマークは、クロードが最初から生成したコンテンツだけでなく、クロードが 処理したコンテンツにも適用されます。アルス氏はこのアプローチを「軌道から核攻撃する」と特徴づけた。なぜなら、EU独自のガイダンスではAIシステムが「標準的な編集のための支援機能」を実行する場合(規則の例は文法修正である)、またはユーザーのテキストを「実質的に変更」しない場合、アンスロピックはサポートされている場合はすべての処理済みコンテンツにマークを付けることを要求していないからだ。

モデル レベルで適用されるウォーターマークでは、コンマ修正を除いて全体的な生成を区別できないため、この区別は重要です。アルス・テクニカのアシュリー・ベレンジャー氏は、クロード氏は、法律で放置されるべきと書かれていた、軽く手を加えられた人間の文章と全く同じものをスタンプしてしまう可能性があると指摘した。実際には、このマークはクロードが処理したものすべてにフラグを立てます。人間が作成し、クロードに推敲を依頼しただけの文書であってもです。

ユーザーは職場や学校で捕まることを恐れています

ユーザーの反応は迅速でした。 TechCrunchは8月13日、一部のClaudeユーザーが「仕事や授業でAnthropicの新しいウォーターマークを使用していることがバレてしまうことに腹を立てている」と報じた。電子メール、レポート、またはスライド資料の下書きを静かにクロードに頼っている従業員、および課題でクロードを使用している学生は、現在、上司や講師が検出ツールへの AI の関与を検証できる可能性に直面しています。

Ars Technica は、この動きを「緋文字」、つまり読者には見えないが、組織がすぐに目に見える AI 使用の目に見えないバッジとして枠組み化しました。透かしはコピー&ペーストや形式の変更を通じてテキストとともに移動するため、「ちょっと編集しただけだ」という通常の防御が AI の指紋を残すことはなくなりました。

引越し市場はすでに出現しています

ウォーターマークがある場合は、除去業界が続きます。 SC Media は、Claude アップデートの数日後に AI 透かし除去ツールの市場がすでに出現していると報告しました。 Decrypt は、ビルダーがマーキング スキームを積極的に破ろうとし、言い換え、翻訳、再フォーマットの下でマーキング スキームがどのように動作するかを調査していることを文書化しました。

初期のテストでは、透かしはカジュアルな取り扱いに対しては丈夫であるが、専門的な条件下では漏れやすいことが示されています。 New Stackの報道では、このマークは「コピー&ペーストは生き残るが、実際の開発ワークフローでは生き残れない」と結論づけている。つまり、通常のエンジニアリングの一環としてAIが提案したコードを大幅に作り直すソフトウェア開発者は、意図せずにマークを洗い流してしまう可能性があるということだ。

マークの実際の仕組み

declaude.org で公開され、広く共有されている視覚的な説明では、そのメカニズムが詳しく説明されています。テキストにはデータを隠すピクセルがなく、コピー&ペーストに耐えるメタデータもないため、透かしは「単語間の選択肢」の中に存在します。モデルは、書き込み中に、同様にもっともらしいいくつかの次の単語の中から繰り返し選択します。秘密の暗号キーは、キーの所有者だけが検出できるパターンに向けてそれらの選択を密かにバイアスします。

この技術は、キルヒェンバウアーらによる研究に遡ります。 2023 年からは、候補単語を「緑」と「赤」のリストに分割し、生成を緑のトークンに傾けました。 Google の SynthID は、より巧妙なルートを通じて同様の目的地に到達しており、Google は 2024 年以降、Gemini アプリと Web エクスペリエンスからのテキストに透かしを入れています。その API は文書化された例外となっています。 2026 年 8 月の時点で、新しいクロード モデルはモデル レベルでテキストをマークし、以前のモデルもこれに続く予定です。

懐疑派は削除は些細なことだと主張

軍拡競争が人類に有利であると誰もが確信しているわけではありません。エンジニアのショーン・ゴデッケ氏は、広く回覧されたエッセイの中で、テキストは非常に圧縮されたメディアであるため、テキストの透かしは「いつでも簡単に削除できる」と主張した。つまり、決定的な削除に耐えられるほど強力な変更は、人間の読者が気づくであろう変更である。言い換えツール、翻訳のラウンドトリップ、および意図的な言い換えはすべて、意味を損なうことなく統計パターンを除去する恐れがあります。

この議論は開発者コミュニティで繰り広げられています。今週、Hacker News で最も話題になった記事の中に 2 人のウォーターマーキング解説者がランクインし、両者の間には何百ものエンゲージメントポイントが集まりました。

次に何が起こるか

Anthropic社は最終的にはマークを検出する方法の詳細(EUの規制が要求する技術サポート)を共有すると述べたが、公的検出ツールが出荷されるまで、外部の第三者はマークが実際にどの程度完全であるかを検証することはできない。同社はまた、ウォーターマークをサポートしていない「一部のプラットフォームまたは機能」ではウォーターマークが機能しないことも認めた。

古いモデルは2026年12月のコンプライアンス期限に直面しており、競合研究所は透明性を理由にユーザーがAnthropicを罰するかどうかに注目しているが、今後数カ月は業界が長年避けてきた命題、つまりAIプロバイダーがAIに依存する人々に害を及ぼすことなく出力を追跡可能にできるかどうかを試すことになる。

---

AIの最新情報をお届け

AIの最新ニュース、分析、ブレイクスルーを一箇所で。

AIニュースをもっと読む →