OpenAI 扩展了 Daybreak 网络安全计划,引入了名为 GPT-5.6-Cyber 的专用模型以及专为专业安全研究人员设计的两个新访问层。此举于 2026 年 8 月 10 日宣布,为经过审查的防御者提供了一个更强大的工具来查找和分析软件漏洞 - 与该公司因网络风险担忧暂停其下一代 Astra 模型的新闻周期相同。
这一扩张凸显了突发人工智能新闻如何日益受到进攻性和防御性网络能力之间紧张关系的影响。 OpenAI 认为,将强大的、拒绝率较低的模型交到可信手中可以战胜人工智能驱动的攻击的威胁。
黎明计划是什么?
Daybreak 于 2026 年 5 月推出,作为网络安全专业人员使用 OpenAI 模型进行漏洞研究的一种方式。由于 OpenAI 的商用大型语言模型包含阻止大多数网络安全提示的过滤器,Daybreak 消除了其中许多限制,因此参与者可以自动执行耗时的安全任务,例如扫描代码、验证补丁和分析恶意软件。
在 8 月更新中,OpenAI 将访问权限分为两层:
- Daybreak Blue — 该公司将其描述为“大多数防御者的起点”。软件团队可以使用它来扫描自己的代码是否存在漏洞,确认补丁是否真正有效,并分析恶意文件等外部代码。
- Daybreak Red — 用于更高级的工作,例如确定新发现的漏洞是否真的可以被利用。该层由 GPT-5.6-Cyber 提供支持。
GPT-5.6-Cyber:经过训练可以减少拒绝的模型
此次更新的核心是 GPT-5.6-Cyber,这是 OpenAI 旗舰 GPT-5.6 Sol 算法的定制版本,该算法针对高级网络安全任务(例如寻找零日漏洞)进行了优化。
为了衡量差异,OpenAI 建立了一个基准,跟踪模型拒绝高级网络安全请求的频率。结果说明了能力的急剧跃升:
- 广泛可用的 GPT-5.6 Sol 仅完成了基准测试请求的 1.5%。
- Daybreak Blue 回答了 2% 的提示。
- GPT-5.6-Cyber 已完成 95%*。
据 OpenAI 称,在一个名为 ExploitGym2 的独立基准测试中,该基准评估漏洞开发能力,GPT-5.6-Cyber 的得分略高于标准 GPT-5.6 Sol 模型。
重要的是,该模型并不是一个免费的模型。 OpenAI 表示,GPT-5.6-Cyber 在开发过程中接受了培训,以阻止特别危险的请求,例如,客户无法使用它来探测实时生产系统中的弱点。
现实世界中的错误发现
OpenAI 表示,其自己的工程师已经将 GPT-5.6-Cyber 用于该领域。据该公司称,该模型帮助发现了Google Chrome 中的两个高严重性漏洞,这些漏洞允许攻击者在 Google 发布补丁之前用恶意代码覆盖浏览器的部分内存。在一个单独的内部项目中,OpenAI 报告发现在一个未命名但广泛使用的数据库中发现了三个关键漏洞。
这些发现旨在证明该模型可以提供防御价值——发现缺陷并加以修复——而不是简单地发起攻击。
更紧的护栏和更宽松的模型
Axios、TechCrunch 和 VentureBeat 等媒体报道的一个值得注意的对比是,Daybreak 扩展发布的同一天,OpenAI 因网络安全问题决定暂停其 Astra 模型的报道仍然新鲜。正如 The Next Web 指出的那样,OpenAI 在周五暂停了一个因网络风险而开发的模型,然后在周一发布了一个经过训练可以减少拒绝的模型。
OpenAI 正在通过访问控制而不是全面拒绝来解决这一风险。从下个月开始,Daybreak 参与者将需要使用硬件安全密钥登录,并且该公司正在推出新的监控功能,旨在检测程序中未经授权或滥用的活动。
为什么这很重要
Daybreak 的扩张反映了更广泛的行业转变。随着人工智能主导的攻击不断增加,防御者认为他们需要的人工智能工具至少与攻击者可用的工具一样强大,而传统的安全过滤器几乎阻止了所有网络安全用例,让合法的研究人员陷入困境。
OpenAI 的方法试图解决这个问题:它没有放松对每个人的限制,而是将强大的功能集中在一个经过验证的参与者的门控、监控程序中。随着模型到达更多人手中,这种平衡是否保持不变将是未来几个月最新人工智能发展的决定性问题之一。
目前,OpenAI 传达的信息是,防御窗口正在缩小——关闭窗口的最佳方法是为合适的人提供更锋利的工具。
保持人工智能领先地位
网络安全只是快速发展的领域中的一个前沿。如需持续报道模型发布、安全辩论和行业转变,请关注我们的人工智能行业报道 和 阅读更多人工智能新闻 →

