Anthropic は木曜日、2026 年 9 月の脅威インテリジェンス レポート「AI の悪用の検出と対策」を発表し、同社の脅威インテリジェンス チームが 2025 年 12 月から 2026 年 8 月の間にクロードを悪用した攻撃者をどのように特定し阻止したかを説明しました。事件は、サイバー作戦、影響力作戦、監視、詐欺と詐欺、生物学的悪用、通常兵器の開発、違法モデルの蒸留という 7 つの異なる被害領域にまたがっています。同社によれば、同社が説明するすべてのキャンペーンは妨害され、情報は必要に応じて当局や業界パートナーと共有されたという。

今週の AI ニュース速報 は安全性に関する情報開示、内部告発、議員からの圧力の高まりによって占められているため、この報告書は AI 業界、特に Anthropic にとって厳しい監視の的となる瞬間に当たりました。また、ニューヨーク・タイムズやポリティコの報道とともに、生物兵器開発に関連した阻止された取り組みなど、フロンティアモデルを兵器化する試みを強調している。

Anthropic が AI を利用した脅威アクターを追跡する方法

Anthropic は、生成的脅威グループ (GTG) と呼ばれる内部指定子に基づいてレポートの中で攻撃者を追跡しています。各ケーススタディでは、同社が「アップリフト」と呼ぶもの、つまり速度、規模、深さの 3 つの側面にわたって AI がオペレーションに与える能力の向上を測定します。悪用事件には、Claude Haiku、Sonnet、Opus のモデルが関係していました。 1件の違法蒸留事件を除いて、同社のFableまたはMythosクラスのモデルは関与していませんでした。

Anthropic は、出版の意欲をマーケティング活動ではなく義務と位置づけ、報告書の中で「当社にはサービスの悪意のある悪用を公開する責任があると信じている」と述べています。

独自のマルウェアを再構築した真夜中のブリザード関連作戦

報告書でGTG-20006として追跡されている最も広範なサイバー事件は、ある攻撃者について記述されており、その帰属は、以前はノーベリウムまたはAPT29として知られていたロシア国家系ハッカー集団、ミッドナイト・ブリザードに関連する公的報告と一致しているとアンスロピックは述べている。運営者の 1 人である「JackPoterz」というハンドル名を使用する個人はロシア語を話します。

報告書によると、このグループはウクライナ政府、軍、外交機関に集中する20以上の組織を標的にしたという。少なくとも 3 つのホテルの WiFi ベンダーを侵害して DNS レコードをハイジャックし、少なくとも 2 人の元ウクライナ高官の WhatsApp アカウントを乗っ取り、北アフリカ政府の技術当局から 50 万社以上をカバーする商業登記データとともに 30 万件以上の国民 ID 記録を盗み出しました。

最も驚くべき詳細は自律的な適応です。Anthropic の報告によると、攻撃者の AI エージェントは、セキュリティ製品がマルウェアを検出するたびに、グループのマルウェアを変更および再構築しました。これまでは、オンデマンドで熟練した開発者が必要だったループです。

大規模な認証情報収集と自律的なゼロデイ ハンティング

2 番目のケース GTG-50014 は、ShinyHunters 集団との関係が疑われるオペレーターを対象としています。彼らの資格情報収集パイプラインは 180 万個の Android APK を大量にダウンロードし、ハードコードされたシークレットをスキャンしました。テクノロジー プロバイダーによる 1 つの侵害では、数百万件の支払いカードの記録を含む、テラバイトを超えるデータが流出しました。別の関連会社は、侵害を受けたサービスとしてのソフトウェア (Software-as-a-Service) プロバイダーの下流顧客約 200 人からデータを抽出し、約 34 時間で 40 社以上の企業テナントにまたがる 2,100 以上の Azure AD トークン セットを廃棄しました。レポートによると、AI エージェントがほぼすべての作業を実行していました。

GTG-10007 は、ディフェンダーにとってさらに厳しい状況です。 Anthropic は、このクラスターはおそらく湖南省長沙に拠点を置く中国語を話すオペレーターによるものであると考えており、そのうち 2 名は学部生であると特定されており、約 50 の組織を標的にし、自主的な脆弱性調査プログラムを実行していたという。ネットワーク アプライアンス上で反復される 1 つのワークフローにより、1 か月間で十数件のゼロデイの可能性のある結果が得られました。

恐喝、孤独なハクティビスト、AI 研究所襲撃の失敗

金銭的動機に基づく悪用の特徴が顕著に表れます。ロシア語を話す俳優 GTG-50020 は、被害者 1 人から約 26 ギガバイトを窃取し、150 万ドルから 250 万ドルの恐喝を求めました。その後、同じグループが、リリース前のクロード モデルにアクセスすることを目的として、約 4 日間で約 30 社の AI 企業を攻撃しました。 Anthropic は、試みられたパスはすべて失敗し、自社のシステムが侵害されることはなかったと述べています。

スペクトルの対極にある GTG-50029 は、フランス語を話す 1 人のハクティビストで、これまで文書化されていなかった WordPress 再インストールの競合状態を少なくとも 4 つのサイトに対して悪用し、追跡対象 42 件のうち少なくとも 14 件への内部アクセスを獲得し、キャンペーン プラットフォームからのユーザーの政治的意見を含む約 140,000 件の記録を流出させました。その後、攻撃者は、数千万行をロードした文書送信プラットフォーム fafsearch を構築しました。

中央アフリカ共和国からマレーシアまでの作戦に影響を与える

報告書にある9件の影響力作戦事件は、ロシア、イラン、トルコ、湾岸、南アジア、アフリカ、ヨーロッパで発生しており、その範囲はブルッキングス研究所のブレイクアウトスケールで測定されている。あるケースでは、バンギに拠点を置くロシア語を話す俳優、GTG-04001がラジオ・レンゴ・ソンゴの毎日のコンテンツを制作した。ラジオ・レンゴ・ソンゴは政治学に関連するアンスロピック局であり、同局が評価しているアフリカ軍団とワグナー影響力部門は2023年末にロシア対外情報局の管理下に入った。この作戦では偽造の中央アフリカ共和国政府文書と同国の大統領とロシアへの忠誠を義務付ける雇用契約書が作成され、その規模でカテゴリー4と評価された。

別のネットワーク GTG-54002 は、約 70 の捏造ニュース Web サイト、70 の一致する X アカウント、および 250 以上の本物のコメント アカウントを運営するフランスに本拠を置くデジタル広告代理店 LKM Company に遡ることが判明しました。このネットワークは少なくとも 8,913 件の記事を約 20 言語で公開しており、そのうち 318 件はコンゴ民主共和国に焦点を当てていました。

選挙も標的となった。 GTG-84005は、Anthropicがイスタンブールに本拠を置くBBS Bilisim Teknolojileriとリンクさせた、マレーシアを狙った商業的選挙操作プラットフォームで、マレーシアの全222の議会選挙区で約1,000の偽Xアカウントを管理し、野党政治家に対する文書を捏造した。別のクラスターである GTG-24015 は、ロシア国営メディアに情報を提供する AI 支援の編集デスクとして 4 つのアカウントを使用しました。

開示が重要な理由

アンスロピックは、それぞれの事件で活動を妨害し、その調査結果を安全策の強化に利用し、必要に応じて当局や業界パートナーと情報を共有したと述べている。独自の検出結果の失敗分析を含む詳細なケーススタディを公開することは、フロンティアラボでは依然として稀であり、同社は透明性が業界全体のベースラインを高めると主張している。

この報告書はまた、セキュリティチームがもはや無視できない変化を強調している。ここで説明されている最も危険なAIを活用した作戦は、架空のデモではなく、政府、企業、選挙に対する実際のキャンペーンだった。 Anthropic のデータは、モデルの能力が高まるにつれて、モデルが断固たる敵対者に与える高揚感が増大していることを示唆しています。そして、現時点で防御側が利用できる最善の答えは、可視性、情報開示、安全対策の迅速な反復です。

---

AI の先を行く

最新の AI ニュース、分析、画期的な情報をすべて 1 か所で入手できます。

AI ニュースをもっと読む→