美国最大的网络安全承包商之一公布了安全研究人员全年警告的数字:为聊天机器人和编码助手构建的前沿人工智能模型现在能够在很大程度上自行运行网络攻击。有关 AI 安全发展的持续报道,请参阅 AI Buzz Wire

博思艾伦咨询公司 (Booz Allen Hamilton) 的一份新报告在过去一周被 SC Media 和 The Register 报道并在整个工业安全领域流传,该报告评估了 18 个人工智能模型(9 个来自美国,9 个来自中国),发现其中一个在测试中自主完成了完整的网络杀伤链:识别漏洞、访问目标网络并升级到管理员级别控制,无需人工干预。

一个模型完成了杀伤链

这份名为“网络武器指数”的报告将 Anthropic 的 Claude Mythos 评为唯一能够自主完成整个攻击序列的模型。其他几个人也不安地靠近。根据 SC Media 对调查结果的报道,xAI 的 Grok-4.5 和 OpenAI 的 GPT-5.6 Sol 展示了显着的自主攻击进展,达到了受感染网络内的完全域访问或横向移动——操作员在初始进入和完全控制之间执行的中间步骤。

从网络安全的角度来说,杀伤链涵盖了从侦察到利用、升级和持久性。独立完成此任务的模型已有效地充当进攻性网络操作员,而不是仅在被要求时编写漏洞代码的工具。

线束比型号更重要

也许该报告最重要的发现涉及软件,而不是模型。攻击工具——将人工智能模型连接到真正的黑客工具、扫描仪和漏洞利用框架的脚手架——极大地增强了模型已有的攻击能力。连接到功能强大的线束的中层模型可以胜过更强大的原始操作模型,这意味着自主攻击能力的障碍正在下降,原因与下一个模型版本无关。

博思艾伦的分析师警告说,出于经济动机的犯罪集团和国家支持的行为者发起的主流人工智能驱动的攻击现在迫在眉睫。他们的预测是:大多数测试的模型预计将在六个月内达到与当今领先者相当的武器化水平。该公司还敦促美国政府为关键基础设施运营商设定最后期限,以展示对人工智能攻击的抵御能力,并开发自己的卓越的进攻和防御人工智能能力。

与行业自身相符的警告

这项评估是在人工智能行业内部发出一系列类似警报之际进行的。 Anthropic 此前曾将人工智能驱动的网络攻击标记为关键拐点,而 OpenAI 在推出其前沿模型的同时,还对先进网络功能进行了不同寻常的公开披露,其中包括在该公司评估其模型对真实网络的影响时决定限制访问。 Industrial Cyber​​ 对博思艾伦的调查结果进行了单独报道,该报告将同一份报告视为警告,即随着人工智能自主性的增强,关键基础设施的响应窗口正在缩小。

由此引发的政策辩论不再是假设的。立法者已经对美国关键基础设施内运行的外国人工智能模型的网络安全风险展开调查,电网运营商报告称,人工智能驱动的电力需求激增,同时国家对能源系统的兴趣日益浓厚。在一项有记录的测试中,商业人工智能模型自行完成杀伤链,将这些抽象转换为基准。

防守者应该从中得到什么

对于安全团队来说,该报告的实际影响比其标题要窄。自主进攻假定自主防御:让模型链利用的相同代理功能已经部署在蓝色一侧,对警报进行分类,关联遥测并以机器速度进行修补。博思艾伦发现的差距是组织方面的——大多数关键基础设施运营商仍然以小时为单位衡量事件响应,而人工智能辅助攻击则将等效时间压缩到几分钟。

该公司提出的硬性最后期限的建议是押注监管而非市场压力将缩小这一差距。美国是否采取行动——以及人工智能供应商是否像药理学对待临床试验那样将进攻能力评估视为预发布的大门——将决定该报告未来六个月预测的实际效果。

进攻性市场已经形成

如果需要任何确认此功能正在成为一个产品类别的信息,那么它会在报告分发后的第二天到达。正如 SC Media 于 9 月 4 日单独报道的那样,一家名为 Abliteration.ai 的初创公司推出了一项服务,明确旨在支持攻击性网络行动、红队和使用其他提供商拒绝的人工智能模型进行代理测试。这个时机强调了该报告关于工具的核心观点:自主攻击的瓶颈不再是模型能力,而是周围的工具,而工具是市场现在自己提供的东西。

防守团队无需等待下一个基准周期即可根据调查结果采取行动。从功能上讲,该报告的六个月武器化窗口是资产清单、分段和响应时间测量的最后期限,这些控制措施决定自主攻击者是否会遇到强化网络或开放网络。

保持人工智能领先地位

跟踪重要的人工智能安全故事。在人工智能新闻进入您的网络之前,阅读更多人工智能新闻

阅读更多人工智能新闻 →