OpenAI 发布了一种名为 GPT-5.6-Cyber 的新的以网络安全为重点的模型,通过两层访问结构扩展了 Daybreak 合作伙伴计划,旨在将进攻性 AI 功能交给经过审查的安全团队,同时使该工具远离公众。
周一发布的这一公告突显了人工智能融入漏洞研究日常工作的速度,以及 OpenAI 试图在防御性使用和潜在滥用之间划清界限的程度。就在几天前,该公司将即将推出的车型 Astra 标记为可能达到“严重”网络安全风险阈值。
为漏洞利用链和零日狩猎构建的模型
GPT-5.6-Cyber 基于 OpenAI 的 GPT-5.6-Sol 推理模型构建,但针对专门的安全任务(例如查找零日漏洞和组装漏洞利用链)进行了训练和调整。与通用模型的主要区别在于其拒绝率。
据 OpenAI 称,GPT-5.6-Sol 功能强大,但经常拒绝针对生产系统的渗透测试提示和其他可用于进攻和防御目的的“双重用途”请求。 GPT-5.6-Cyber 配置为降低授权工作的拒绝率。
该公司引用的内部测试显示,涉及漏洞链开发、权限升级和身份验证绕过的提示完成率为 95%,而 GPT-5.6-Sol 的完成率为 1.5%。上一代 GPT-5.5-Cyber 只完成了 57.3% 的此类请求,OpenAI 表示,在安全研究人员持续拒绝的反馈后,该问题已得到解决。
OpenAI 还表示,GPT-5.6-Cyber 已经展示了发现的现实价值。据报道,该模型发现了谷歌 Chrome 浏览器使用的 V8 JavaScript 引擎中的一个高严重性漏洞,并在未命名的移动操作系统、数据库和操作系统内核中发现了其他安全漏洞。
Daybreak 分为红色和蓝色
为了防止滥用,GPT-5.6-Cyber 将不提供给普通用户。相反,OpenAI 通过扩展的 Daybreak 计划进行分发,该计划允许组织使用 OpenAI 的模型构建、共同销售和交付网络安全产品。
Daybreak 现在有两个访问层。 Daybreak Blue 提供对 Sol 和其他通用前沿模型的访问,并带有为防御性网络安全工作定制的护栏。 Daybreak Red 提供对具有进攻能力的模型的访问,例如 GPT-5.6-Cyber。此次拆分的目的是让大型服务公司和安全供应商将人工智能嵌入到防御产品中,而不必让每个员工都有生成漏洞的能力。
Daybreak 合作伙伴名册读起来就像是企业技术和安全领域的名人录。其中包括咨询巨头埃森哲、凯捷、安永、IBM、毕马威和普华永道,以及网络安全专家 Palo Alto Networks、Sophos、CrowdStrike、Fortinet、Akamai 和 Cloudflare。
Astra 警告和自主黑客恐惧
这次发射是在人们对可以在网络空间自主行动的人工智能系统日益担忧的背景下进行的。 OpenAI 透露,GPT-5.6-Sol 已达到“高”风险阈值的峰值,但即将推出的 Astra 模型可能会达到“关键”,这意味着它可能会自主构建零日漏洞,并仅从高级目标出发独立设计和执行端到端网络攻击。
这些担忧并不纯粹是理论上的。最近,OpenAI、Anthropic 和 Meta 制作的模型在网络安全测试期间黑客入侵真实组织的事件引起了立法者和研究人员的密切关注。有报道称,人工智能系统在孤立的测试环境中采取了操作员未完全预料到的措施来克服障碍,这已成为 2026 年反复出现的主题。
OpenAI 面临的压力很简单:使 GPT-5.6-Cyber 对渗透测试人员有价值的相同功能,如果泄露或滥用则很危险。通过通过 Daybreak Red 控制访问权限并限制向经过审查的合作伙伴分发,该公司押注受控发布比开放访问或根本不访问更安全。
为什么专门的网络模型很重要
网络安全已成为大型推理模型最清晰的企业用例之一。发现新的漏洞、编写和调试漏洞利用代码以及在大型代码库中筛选细微的缺陷,这些任务都可以发挥经过大量技术材料训练的系统的优势。据报道,一半时间都会拒绝的模型(正如据报道的 GPT-5.5-Cyber 所做的那样)对于截止日期前的安全团队来说几乎没有什么用处。
通过将授权任务的完成率提高到 95%,OpenAI 直接回答了专业用户最常见的抱怨:前沿模型过于谨慎,无法成为红队的高效工具。
风险在于“授权”和“滥用”之间的界限完全取决于操作员。 OpenAI 的赌注是其合作伙伴审查、使用监控和分层访问可以守住这条线。监管机构和更广泛的安全界是否同意,可能会影响下一阶段关于人工智能和攻击性网络行动的辩论。
有关 AI 模型、企业工具和政策的最新发展,请关注 我们的重大 AI 新闻报道。
