Anthropic 周四发布了 2026 年 9 月的威胁情报报告,《检测和反击人工智能的滥用》,描述了其威胁情报团队如何识别和瓦解在 2025 年 12 月至 2026 年 8 月期间滥用 Claude 的威胁行为者。这些案例涵盖七个不同的危害领域:网络行动、影响力行动、监视、诈骗和欺诈、生物滥用、常规武器开发和非法模型蒸馏。据该公司称,其描述的每一项活动都被中断,并在适当的情况下与当局和行业合作伙伴共享情报。

该报告发布之际,人工智能行业,尤其​​是 Anthropic 正受到严格​​审查,因为本周的人工智能突发新闻主要是安全披露、举报人和立法者不断加大的压力。与此同时,《纽约时报》和《Politico》的报道也强调了将前沿模型武器化的尝试——包括与生物武器开发相关的受阻努力。

Anthropic 如何追踪人工智能威胁参与者

Anthropic 在其报告中通过称为“生成威胁组织”(GTG) 的内部指定名称来追踪参与者。每个案例研究都衡量公司所说的提升——人工智能在三个维度上给运营带来的能力提升:速度、规模和深度。滥用案例涉及 Claude Haiku、Sonnet 和 Opus 模型。除一起非法蒸馏案件外,没有一起案件涉及该公司的《寓言》或《神话》级模型。

Anthropic 将其发布信息的意愿视为一种义务,而不是一种营销活动,并在报告中指出,“我们认为我们有责任披露对我们服务的恶意滥用行为。”

一次与午夜暴雪相关的行动,重建了自己的恶意软件

该报告中最广泛的网络案例被追踪为 GTG-20006,描述了一名攻击者,Anthropic 称该攻击者的身份与将其与 Midnight Blizzard 联系起来的公开报道一致,Midnight Blizzard 是俄罗斯国家联盟的黑客组织,以前称为 Nobelium 或 APT29。其操作员之一,用户名为“JackPoterz”,会说俄语。

报告称,该组织针对 20 多个组织,主要集中在乌克兰政府、军事和外交机构。它入侵了至少三个酒店 WiFi 供应商,劫持了 DNS 记录,接管了至少两名前乌克兰高级官员的 WhatsApp 帐户,并从北非政府技术机构窃取了超过 300,000 份国家身份记录以及涵盖超过 50 万家公司的商业注册数据。

最引人注目的细节是自主适应:Anthropic 报告称,只要安全产品检测到该组织的恶意软件,攻击者的人工智能代理就会修改并重建该恶意软件——以前需要熟练的开发人员按需进行循环。

大规模凭证收集和自主零日狩猎

第二个案例 GTG-50014 涉及涉嫌与 ShinyHunters 集体有联系的运营商。他们的凭证收集管道大量下载了 180 万个 Android APK,并扫描它们以获取硬编码的秘密。在技​​术提供商的一次妥协中,超过 1 TB 的数据被泄露,其中包括数百万条支付卡记录。报告称,另一家附属公司从一家遭到入侵的软件即服务提供商的大约 200 个下游客户中提取了数据,并在大约 34 小时内转储了涵盖 40 多个企业租户的 2,100 多个 Azure AD 令牌集,而人工智能代理几乎完成了所有工作。

对于防御者来说,GTG-10007 更加发人深省。 Anthropic 将这个集群归因于可能位于湖南长沙的中文操作员(其中两人是本科生),他们针对大约 50 个组织并运行一个自主漏洞研究项目。一个工作流程在网络设备上进行迭代,在一个月内产生了十多个可能的零日结果。

敲诈勒索、孤独的黑客活动分子以及对人工智能实验室的失败袭击

出于经济动机的滥用行为尤为突出。 GTG-50020 是一名俄语演员,从一名受害者身上窃取了大约 26 GB 数据,并勒索了 150 万至 250 万美元。随后,该组织在大约四天内攻击了大约 30 家人工智能公司,其既定目标是访问预发布的 Claude 模型。 Anthropic 表示,每条尝试的路径都失败了,而且它自己的系统从未受到损害。

另一方面,GTG-50029 是一名讲法语的黑客活动分子,他利用了之前未记录的 WordPress 重新安装竞争条件,攻击了至少 4 个站点,获得了对 42 个跟踪目标中至少 14 个的内部访问权限,并窃取了大约 140,000 条记录,包括来自竞选平台的用户的政治观点。然后,该演员建立了一个人肉搜索平台 fafsearch,加载了数千万行数据。

从中非共和国到马来西亚的影响力行动

报告中的九个影响力行动案例源自俄罗斯、伊朗、土耳其、海湾、南亚、非洲和欧洲,影响范围按照布鲁金斯学会的突破量表进行衡量。在一个案例中,班吉的一名俄语演员 GTG-04001 为 Lengo Songo 电台制作每日内容,该电台是一家与政治学相关的人性电台——该电台评估非洲军团和瓦格纳影响力分支于 2023 年底受到俄罗斯对外情报局的控制。该行动伪造了中非共和国政府文件和雇佣合同,要求效忠于该国总统和俄罗斯,并被评估为第四类。

另一个网络 GTG-54002 被追踪到 LKM 公司,这是一家总部位于法国的数字广告公司,运营着大约 70 个捏造的新闻网站、70 个匹配的 X 帐户以及 250 多个不真实的评论帐户。该网络以约 20 种语言发表了至少 8,913 篇文章,其中 318 篇重点关注刚果民主共和国。

选举也是一个目标。 GTG-84005 是一个针对马来西亚的商业选举操纵平台,Anthropic 与总部位于伊斯坦布尔的 BBS Bilisim Teknolojileri 建立了联系,在马来西亚所有 222 个议会选区管理着约 1,000 个虚假 X 账户,并捏造了针对一名反对派政客的档案。一个单独的集群 GTG-24015 使用四个账户作为人工智能辅助编辑台,为俄罗斯官方媒体提供数据。

为什么披露很重要

Anthropic 表示,它扰乱了每起案件的活动,利用调查结果加强其保障措施,并在适当的情况下与当局和行业合作伙伴共享情报。在前沿实验室中,发布详细的案例研究(包括对其自身检测的失败分析)仍然很少,该公司认为透明度提高了整个行业的基线。

该报告还强调了安全团队不能再忽视的一个转变:这里描述的最危险的人工智能行动不是假设的示威活动,而是针对政府、公司和选举的现场活动。随着模型的能力变得越来越强大,Anthropic 的数据表明,它们为坚定的对手提供的提升正在复合化——而防御者目前最好的可用答案是可见性、披露和更快的防护措施迭代。

---

保持人工智能领先地位

获取最新的人工智能新闻、分析和突破——尽在一个地方。

阅读更多人工智能新闻 →