该公司于 2026 年 8 月 7 日证实,在即将推出的 Astra 模型表现出强大的网络安全能力足以引发内部暂停后,OpenAI 已放慢了该模型的发布速度。据报道,Astra 已接近 OpenAI 所定义的“关键”网络风险阈值,使其成为该公司安全框架下第一个接近该水平的模型。

有关最新的人工智能安全新闻和政策报道,请访问 AI Buzz Wire

发生了什么

Axios 于 8 月 7 日首次报道了这一进展,称其为 OpenAI 以网络能力为由减缓 Astra 发布的独家披露。 The Verge 将这种情况描述为 OpenAI 对新模型踩刹车,因为它被认为在某些安全相关领域过于强大。

彭博社报道称,出于网络担忧,OpenAI 暂停了 Astra 模型的一些工作。 《卫报》证实,暂停与模型功能的安全考虑有关。

OpenAI 的回应

OpenAI 于 8 月 7 日发表了一篇题为“应对关键网络能力的下一个前沿”的博文,概述了其管理接近网络安全领域危险阈值的模型的方法。

《福布斯》8 月 9 日报道,OpenAI 在 Astra 模型接近该公司准备框架下的首个“关键”网络风险级别后暂停了该模型。这标志着人工智能安全治理的一个重要时刻,因为之前没有模型达到过这种分类。

CNBC 8 月 10 日报道称,随着更广泛的人工智能安全争论加剧,OpenAI 加强了对新模型的控制。该网络指出,这一决定是在人工智能模型遭到大量黑客攻击以及对前沿模型如何处理网络安全任务的日益严格审查的背景下做出的。

关键能力阈值

OpenAI 的准备框架对包括网络安全在内的多个领域的模型风险进行分类,并分配从低到严重的风险级别。关键级别代表可以有效协助复杂网络攻击的能力,例如发现新漏洞、编写漏洞代码或大规模自动化攻击操作。

据 Help Net Security 称,OpenAI 因潜在的关键网络功能而锁定了 Astra。在发布此风险级别的模型之前,该公司的框架需要额外的安全措施、评估和潜在的外部审查。

Astra接近这一门槛的事实反映了前沿模型的快速进步。随着模型在编码、推理和系统分析方面的能力越来越强,它们在防御性和进攻性网络安全方面的潜在效用也会成比例增长。

为什么这很重要

Astra 的暂停是对自愿人工智能安全承诺的一个重要测试案例。 OpenAI 根据内部安全评估决定减缓旗舰模型的发布,这表明前沿能力阈值不仅仅是理论构建。它们是由真实模型触发的。

这一发展正值人们对人工智能网络威胁的高度关注之际。 《黑客新闻》指出,OpenAI 的下一个模型显示出强大的网络性能,足以引发暂停。网络安全社区一直在密切关注前沿人工智能模型是否可用于自动发现漏洞或大规模生成漏洞代码。

Gizmodo 提出了一个更加持怀疑态度的框架,表明最强大的模型并不是唯一能够引发重大网络安全事件的模型,并指出较小的模型已经与现实世界的攻击有关。

更广泛的政策背景

Astra 的暂停是在监管环境不断加强的背景下发生的。欧盟的人工智能法案包括针对高风险人工智能系统的规定,美国一直在开发自己的框架来管理前沿人工智能能力。行业观察人士指出,OpenAI 等公司的自愿安全暂停可能会为未来的监管方法提供参考。

该决定还引发了竞争问题。如果 OpenAI 出于安全考虑而放慢发布节奏,而竞争对手行动更快,那么市场动态可能会发生变化。然而,OpenAI 似乎押注负责任的部署将与企业客户和监管机构建立长期信任。

接下来会发生什么

OpenAI 尚未宣布 Astra 发布的修订时间表。该公司的博客文章表明,它正在开发新的评估方法和安全协议,专门为接近关键网络能力水平的模型设计。

这一暂停也凸显了人工智能行业日益紧张的局势。随着模型的能力变得越来越强大,有用的网络安全工具和危险的攻击能力之间的界限变得越来越难以划清。公司如何驾驭这条路线可能不仅决定他们自己的产品路线图,还决定未来几年人工智能治理的形态。

保持人工智能领先地位

如需深入了解人工智能政策、安全和前沿模型开发,请关注 AI Buzz Wire

阅读更多人工智能新闻