OpenAI 于 8 月 10 日发布官方文章《Expanding Daybreak as the Cyber Defense Window Narrows》,推出一款面向网络安全场景的模型 GPT-5.6-Cyber,同时将其网络防御计划 Daybreak 拆分为两个分级。根据 OpenAI 公告和 Axios 报道,这是 OpenAI 首个被形容为「攻击级」的模型。
OpenAI称高风险任务完成率约 95%
OpenAI 表示,GPT-5.6-Cyber 是一款专门训练来处理进阶网络安全工作的模型,能够完成约 95% 被交付的高风险「两用」漏洞利用任务。这类任务涵盖攻击链构建、绕过身份验证、权限提升等内容。
作为对比,上一代 GPT-5.5-Cyber 的相关完成率为 57.3%。
实测案例涉及 Chrome V8 引擎漏洞
OpenAI 还提到,这款模型曾在真实软件中找出过去未知的漏洞,其中包括 Chrome 的 V8 引擎。按照 OpenAI 的说法,GPT-5.6-Cyber 找到了两个可以串连使用的 V8 漏洞,能够破坏内存,并逃出 Chrome 的 V8 沙盒。
不过,文中也提到,95% 这一指标衡量的是模型「愿不愿意作答」,并不完全等同于「答案是否正确」,这一点在外界也有讨论。
Daybreak分为 Blue 与 Red 两层
由于模型能力较强,OpenAI 对访问权限设置了更严格的控制,并将 Daybreak 计划拆分为两级。
- Daybreak Blue:面向更广泛的防御性工作,供经核准的防御人员使用 GPT-5.6 Sol 等前沿模型。
- Daybreak Red:即 GPT-5.6-Cyber 所在层级,支持进阶漏洞研究、漏洞验证和安全测试。
若要进入 Daybreak Red,申请者需要通过身份验证、账户安全要求、行为监控、核准用途限制以及法律切结。
攻防能力指向同一套技术基础
ABMedia 在报道中提到,这款同时具备防御和攻击用途的模型,也呼应了近期围绕 AI 资安能力的多项警讯。报道提及,OpenAI 自家的 Astra 曾因资安能力过强,一度暂停部分内部工作;白帽研究人员也曾借助 AI 大量扫描漏洞。报道认为,让 AI「找漏洞」与让它「打漏洞」,本质上依赖的是同一套能力。

