在内部安全测试发现该公司所说的关键网络安全风险后,OpenAI 暂停了其下一代模型(内部称为 Astra)的一些工作。该决定最初由路透社于 2026 年 8 月 7 日报道,并得到 Axios、《卫报》和《华尔街日报》的确认,标志着主要人工智能实验室与网络能力阈值相关的最重大的模型延迟之一。有关模型安全和人工智能行业的持续报道,请关注我们的突发人工智能新闻

新的网络能力前沿

该公司在同一天发布的一篇题为“应对关键网络能力的下一个前沿”的博客文章中披露了这一暂停。据 OpenAI 称,对 Astra 模型的评估确定了跨入其准备框架最高层的能力,该框架是该公司用于对网络安全、说服和自主等领域的风险进行分类的系统。

OpenAI 没有公布所涉及的特定网络功能的完整技术细节,这是披露敏感模型风险时的常见做法。然而,该公司认为这些发现足够重要,有必要放慢模型的开发时间表,并在任何潜在发布之前实施额外的保护措施。路透社报道称,OpenAI“在即将推出的模型中标记了可能存在的关键网络安全风险”,并采取了“加强控制”的措施。

准备框架的含义

OpenAI 的准备框架旨在在前沿模型向公众公布之前,根据定义的风险阈值对其进行评估。该系统使用评分标准,并且在给定领域中接近或超过“关键”级别的模型会触发强制审查、额外的红队,以及(如 Astra 的情况)潜在的部署延迟。

该框架于2023年建立,并定期更新。在目前的结构下,模型必须明确模拟潜在误用场景的安全评估。特别是对于网络安全而言,评估评估模型是否可以有效地协助攻击性操作,例如发现漏洞、编写漏洞代码或进行大规模网络钓鱼活动。

事实上,Astra 触发了关键阈值,表明前沿模型现已达到能力水平,网络领域有益和有害应用程序之间的差距正在缩小——这是整个行业正在努力应对的挑战。

这与过去的延误相比如何

在 OpenAI 中,因安全问题导致的模型延迟并非史无前例,但它们通常集中在生成不允许的内容或产生欺骗性输出等风险上。阿斯特拉的暂停值得注意,因为它与网络能力达到公司本身归类为关键的水平特别相关。

TechCrunch 证实了这一消息,并指出 OpenAI“出于安全考虑而放慢了 Astra 模型的开发”,并将这一决定视为该公司不断发展的负责任扩展方法的一部分。据《卫报》报道,OpenAI 决定“暂停该模型的部分工作”,而不是彻底取消,这表明该公司打算在加强保障措施的情况下继续开发。

日本公共广播公司 NHK 也报道了这一进展,反映了鉴于 OpenAI 的国际用户群以及跨司法管辖区对前沿模型安全性日益严格的审查,该故事具有全球意义。

对全行业的影响

Astra 的延迟到来之际,关于人工智能公司应如何评估和披露模型风险的争论日益激烈。美国、欧盟和英国的监管机构都在推动提高前沿模型能力的透明度,一些政府还建立了人工智能安全机构,专门测试网络、生物和其他风险的先进模型。

OpenAI 决定公开披露关键能力的发现,而不是悄悄地在内部解决它,这符合更广泛的行业自愿透明的趋势。 Anthropic 和 Google DeepMind 等公司也发布了类似的准备和负责任的扩展承诺,尽管他们的评估方法的具体细节有所不同。

对于网络安全界来说,这一事件凸显了一个日益增长的担忧:随着模型变得更加强大,跟上步伐所需的防御措施和评估框架也必须进步。能够识别零日漏洞或自动化部分攻击链的模型既为防御安全团队提供了机会,也为坏人带来了风险。

Astra 的下一步是什么

OpenAI 尚未宣布 Astra 发布的修订时间表。该公司表示,开发将在采取额外保障措施的情况下继续进行,这表明一旦已识别的风险得到充分缓解,该模型最终可能会启动。

行业分析师将密切关注这种延迟是否是短暂的(需要数周或数月的额外红队),还是表明将具有关键级别网络功能的模型安全推向市场面临着更根本的挑战。

这一集还引发了竞争性问题。 OpenAI 面临着来自 Anthropic、Google、Meta 和新兴中国实验室等竞争对手的压力,所有这些公司都在竞相发布更强大的模型。出于安全原因的延误虽然是负责任的,但可能会在快速变化的市场中让步——这是前沿模型竞赛的核心紧张局势。

保持人工智能领先地位

人工智能功能与安全性的交叉正在成为行业的决定性故事之一。如需有关模型安全、前沿发展和塑造该领域的公司的清晰来源报告,请为我们的主页添加书签并阅读更多人工智能新闻→,网址为 https://aibuzzwire.news