Anthropic 周二宣布大幅扩展其以安全为重点的模型访问工作,将其审查访问计划重组为正式的网络验证计划 (CVP),为网络安全专业人员提供三个不同的级别。此举出台之际,该公司透露,自 4 月份以来,其 Project Glasswing 计划已发现至少 129,000 个经过验证的软件漏洞。

重组后的程序允许经过审查的安全团队运行 Anthropic 最强大的模型 - 包括 Claude Opus 5.5、Claude Sonnet 5.5 和 Claude Mythos 5.1 - 并减少保护措施和阻止分类器以及一般用户通常无法获得的权限。据 Anthropic 称,其目标是在恶意行为者将前沿人工智能能力武器化之前,将前沿人工智能能力交到防御者手中。 更多相关背景,请参阅我们的AI行业报道。

Three Access Tiers, Three Threat Scenarios

新计划围绕三个访问级别进行组织,每个级别都针对不同类型的安全工作量身定制:

  • 防御访问涵盖防御操作,例如事件响应、恶意软件逆向工程以及漏洞分析和验证。
  • 红队访问在防御用例中添加了授权渗透测试和红队,允许对组织有权测试的系统进行模拟攻击。
  • 专业访问具有最少的保障措施,并保留给有限的一组经过验证的组织,这些组织被授权自行测试人工智能安全系统。

组织和个人安全团队申请与其工作相匹配的级别,Anthropic 在授予访问权限之前会审核每个申请。该公司表示,所有三个级别都包括使用其当前的旗舰型号以及未来发布的新型号。

Safeguards Still Bite — Selectively

Anthropic 将这一公告与评估数据结合起来,旨在表明分级系统将良性防御工作与真正危险的能力区分开来。在对 Claude Opus 5.5 的 CyScenarioBench 评估中,该公司报告称,防护措施阻止了防御访问层中 50 项任务中的 46 项。在同一模型的红队访问层中,没有任何任务被阻止,模型完成了 50 项任务中的 34 项——与完全不应用任何保护措施时记录的完成率相同。

相比之下,根据 Anthropic 的说法,如果没有 CVP 访问权限,每项任务都会在第一个提示时被阻止。

该公司在其声明中表示:“这些评估让我们相信,我们可以为更广泛的防御者安全地提供先进的网络功能,从而扩大我们从 Glasswing 项目开始的防御工作。”该声明得到了《黑客新闻》、路透社和《安全周刊》的广泛报道。

该设计反映了一种赌注,即大多数防御性安全工作(修补、日志分析、恶意软件分类)都可以在严格的护栏下进行,而合法的攻击性测试则需要更宽的走廊。它还反映了安全行业长期以来处理双重用途工具的方式:审查从业者,而不仅仅是工具。

Glasswing's Expanding Footprint

该计划扩展与 Anthropic 的 Glasswing 项目紧密结合,旨在将其模型应用于强化关键软件。该公司表示,Glasswing 在 2026 年 4 月至 7 月期间发现了至少 129,000 个经过验证的软件漏洞,并在 4 月至 10 月期间通过开源扫描工作发现了另外 5,500 个经过验证的漏洞。

在已验证的漏洞中,迄今为止有超过 33,000 个被评为严重或高严重性 — Anthropic 称这个数字可能严重低估,因为它仅利用了来自 Glasswing 合作伙伴子集的调查数据。该公司估计真正的影响可能至少高出五倍。

人工智能驱动的漏洞发现的衡量视角

独立分析表明,人工智能发现的大量缺陷并不会直接转化为相应的漏洞利用浪潮。在上个月末发布的一份分析中,VulnCheck 研究员帕特里克·加里蒂 (Patrick Garrity) 发现,Anthropic 或 Project Glasswing 发现的 300 个漏洞中只有 2 个(约占 0.67%)已被利用。

这两个被利用的漏洞是 CVE-2026-26980(Ghost CMS 中的 SQL 注入漏洞)和 CVE-2026-61500(Rejetto HTTP 文件服务器中的会话伪造漏洞)。这些数据支持了安全研究人员一直强调的一个细微差别:人工智能正在降低漏洞发现的障碍,但它所暴露的大多数缺陷从未出现在攻击者的雷达上。

该公告还引发了有关人工智能生成的安全工作的更广泛辩论。 1Password 和 Veracode 的研究表明,人工智能编写的漏洞补丁本身可能会引入新的缺陷,这强调了自动化可以提供帮助,但不能取代人工验证。

这对安全行业意味着什么

对于安全团队来说,CVP 降低了在实际防御工作中使用前沿模型的激活能。事件响应者获得恶意软件分析援助的认可途径;渗透测试人员获得用于人工智能辅助攻击的受控环境;审计人工智能安全系统的一小部分组织本身受到的访问限制最少。

对于 Anthropic 来说,该计划既是一项安全战略,也是一项商业战略。它具体化了该公司的立场,即强大的网络能力应该有意识地向经过审查的防御者释放,而不是完全压制——这与那些因网络控制较弱的模型而面临审查的竞争对手形成鲜明对比。它还加深了 Anthropic 与最有可能为前沿模型访问付费的企业的关系:政府、关键基础设施运营商和大型安全供应商。

该公司没有宣布与该计划相关的价格变化,并且申请是通过 Anthropic 现有的经过审查的访问渠道进行处理的。考虑到 Glasswing 已经浮出水面的规模——以及该公司自己承认这些数字可能低估了现实——安全行业将关注这 129,000 个发现中的有多少在攻击者首先发现它们之前得到修复。

---

掌握AI最新动态

获取最新的AI新闻、分析和突破——尽在一处。

阅读更多AI新闻 →