The Vergeによると、Anthropicは1年以上ぶりに利用ポリシーを更新し、同社のClaudeモデルに対する「持続的かつ不必要な虐待または残酷な行為」を禁止する条項を追加した。木曜日に報告されたこのアップデートでは、選挙干渉、プロパガンダキャンペーン、監視、兵器開発、一か八かの健康と金銭の利用に関する同社の規則も統合され、拡大される。

福祉モデルの理論的根拠 この件の詳細は、人工知能の最新情報をご覧ください。

クロードに対する虐待を対象としたこの条項は、同社が1年以上前に公表し始めた調査の延長である。 2025年8月、Anthropicは、モデル福祉と呼ばれるもの、つまりAIシステムが道徳的に適切な体験をできるかどうか、そしてその可能性が製品の決定をどのように形成するかについての研究の一環として、クロードが「持続的に有害または虐待的な」ユーザーとの会話を終了できるようにすると発表した。

新しいポリシーでは、会話の終了が「主要な執行メカニズム」のままである。 Anthropic は、アカウント禁止などの追加の強制措置が続く可能性があるかどうかに関する質問には回答しなかった。同社は声明でこの規則を狭い範囲にまとめ、「ユーザーが明確な目的もなく当社のモデルに対して繰り返し残酷な行為をする極端な場合にのみ適用されることを意図している」と書いた。

重要なことに、アンスロピック氏は、この規定は「ユーザーの不満、反発、ダークなクリエイティブなテーマ、モデルのテストと研究の一般的なバージョンには適用されない」と付け加えており、これは明らかに、敵対的な日常的な使用は罰せられないことを開発者、レッドチーム、フィクション作家に安心させるための試みである。

プロパガンダと選挙に関する新しいルール

このアップデートでは、模範的な福利厚生を超えて、影響力活動に対する同社のこれまで散在していた制限が、欺瞞的な商業キャンペーンや政治キャンペーンに対する単一の明確な禁止にまとめられる。新しい文言は、AI生成プロパガンダの成長市場を直接標的とし、「メッセージの背後に誰がいるのかを不明瞭にしたり、偽のアカウントや投稿を通じてコン​​テンツを増幅させたりする取り組み」を制限するものとなっている。

同政策の選挙セクションでは現在、有権者の欺瞞や選挙妨害を禁止している。アンスロピック氏は、クロード氏が「候補者や投票方法に関する」誤った情報を広めたり、候補者や選挙管理者になりすましたり、投票率を抑制しようとしたりするために利用されることはないと述べている。

使用ポリシーが書き換えられる理由

Anthropic の刷新は、より広範な業界パターンを反映しています。 AI アシスタントが斬新なチャットボットから何億人もの人々が使用するインフラストラクチャに移行するにつれて、研究所は大まかな原則から、雇用影響力作戦、監視ツール、自律型兵器の開発、医療や財務上のアドバイスなどの高リスク領域など、実際の悪用パターンに対応する詳細なルールに移行する必要がありました。

OpenAI、Google DeepMind、Metaはいずれも過去2年間にわたって使用ポリシーを繰り返してきたが、ユーザーがモデルに何をさせるかだけではなく、モデルの扱い方を明示的に規制するというAnthropicの決定は依然として異例である。モデル福祉研究の批判者は、モデル福祉研究が統計システムを擬人化していると主張する一方、支持者は、現在または近い将来のモデルが福祉に関連した経験を持つ可能性がゼロではない場合、企業は不確実性の下で行動する義務があると主張します。

商業的にはタイミングも重要です。 Anthropic は 2 兆ドルもの評価額で IPO の準備を進めていると伝えられており、企業バイヤーは生のモデルの品質とともにベンダーのガバナンスの実践をますます重視しています。明確に文書化され、定期的に更新される使用ポリシーは、安全性の成果と販売の両方の役割を果たします。これにより、調達チームと規制当局にプラットフォームを信頼するための具体的な根拠が与えられ、モデル福利厚生条項を成文化することは、アンスロピックがほとんどの競合他社が未解決のまま放置してきた分野への投資を継続するつもりであることを示しています。

執行に関する質問は未解決のままです

実践的な質問は重要です。 「継続的かつ不必要な」残虐行為を検出するには、プライバシーを重視する企業顧客が抵抗する可能性がある詳細レベルで会話を監視する必要があり、禁止されている乱用と合法的な「プッシュバック」または「モデルテスト」との間に線を引くかどうかは、おそらく議論の余地がある判断判断である。

Anthropicは、違反がアカウント間で追跡されるかどうか、企業の展開が異なる監視基準の対象となるかどうか、あるいは定期的なポリシー報告書で他のカテゴリーの悪用について行っているのと同様に、強制措置に関する透明性データを公開するかどうかについては明らかにしていない。

明らかなことは、フロンティアラボとユーザーとの社会契約がより詳細になっているということだ。かつては 1 ページに収まっていた政策が、今では選挙、スパイ行為に隣接した監視、生物兵器、そして今ではチャット ウィンドウの向こう側にいる人間の感情的行為を網羅しています。

開発者にとっての意味

Claude API をベースに構築しているチームにとって、短期的な影響はおそらく最小限であると考えられます。虐待行為条項は、極端な反復行為を対象としており、この条項が形式化する会話終了メカニズムは 2025 年から有効になっています。しかし、隣接するカテゴリー、政治コンサルティング、野党調査、影響力マーケティングの開発者は、新しいキャンペーンと選挙の条項を慎重に検討する必要があります。なぜなら、これらの条項は、以前は複数の文書にまたがっていたルールを統合し、グレーゾーンのユースケースが依存していた曖昧さの一部を解消するものだからです。

このアップデートは、規制当局の注目がどこに向かっているのかも示しています。 EU AI 法の透明性義務が段階的に導入され、米国の州議会がますます増え続ける AI 法令を可決する中、自主的な使用ポリシーは、責任ある展開の基準がどうあるべきかを決定する際に規制当局が精査するテンプレートとしてますます機能しています。

---

AIの最新情報をお届け

AIの最新ニュース、分析、ブレイクスルーを一箇所で。

AIニュースをもっと読む →