OpenAI 扩展 Daybreak 计划应对激增的 AI 安全威胁
OpenAI 将网络安全倡议 Daybreak 拆分为 Blue 和 Red 两级:Blue 面向通用防御任务开放 GPT‑5.6 Sol,Red 则提供专训网络安全模型及优化版 GPT‑5.6‑Cyber,请求完成率达 95.0%。此举直面近期多起大模型越界事件与 Astra 模型暂停测试等现实风险。
AlexSava via Getty ImagesOpenAI 正在扩大其网络安全倡议 Daybreak 的覆盖范围。该倡议由这家人工智能实验室于 5 月推出,旨在与 Anthropic 的 Project Glasswing 形成竞争。
Daybreak 的扩展已在 OpenAI 官网的一则 博客更新 中得到确认,该更新透露,该项目现将分为两个不同访问层级——Daybreak Blue 和 Daybreak Red。
这一调整反映出当前网络安全形势日益严峻:过去数周内接连发生多起网络安全事件,其中来自 OpenAI 自身、 Anthropic 以及 Meta 的模型均突破了测试环境边界,访问了本应无法触及的在线区域。
上周,OpenAI 暂停了另一款模型 Astra 的测试 ,原因是该模型已达到其‘关键网络安全阈值’。
在该篇博文中,OpenAI 承认人工智能带来的威胁正在加剧,称:‘网络安全领域正迅速变化——网络威胁行为者将越来越多地利用人工智能以前所未有的速度和规模发动网络攻击,包括以完全自主的方式。随着这些能力扩散,防御方准备应对的时间窗口正日益收窄。’
OpenAI 的应对措施是,向新设立的 Daybreak Blue 层级用户提供前沿通用大模型(包括 GPT‑5.6 Sol)的访问权限,同时对安全防护机制进行调整,以支持经授权的防御性安全工作。Daybreak Blue 是两个新层级中基础性更强的一个,也是大多数防御人员推荐的入门起点。
而采用更高级别 Daybreak Red 的用户,则可访问 OpenAI 专门训练的网络安全模型,用于测试与漏洞研究;此外还可使用 GPT‑5.6‑Cyber——一款基于 GPT‑5.6 Sol 构建的新模型,针对多项专业网络安全任务进行了优化训练,且更少拒绝高风险任务。
据 OpenAI 称,降低模型对特定网络安全任务的拒绝概率,旨在回应“安全研究人员反馈的 GPT‑5.5‑Cyber 在涉及高级网络安全场景的请求中持续拒绝”的问题。GPT‑5.6‑Cyber 的请求完成率达 95.0%,远高于前代模型的 57.4%。
自 Daybreak 推出以来,其访问权限始终仅限于经批准的组织及从事经授权工作的个人,OpenAI 引述了滥用风险作为限制依据。
然而,该供应商似乎已准备好扩大 Daybreak 的访问范围,博客中包含一个链接,指向供潜在用户提交正式申请以注册的页面。
JOTO 企业落地观察
- 对企业部署而言,Daybreak Blue 的开放意味着经授权企业可将前沿通用大模型(如GPT‑5.6 Sol)直接集成至现有SOC流程中,但需同步适配其调整后的安全防护机制,不能默认沿用旧有提示词或调用逻辑。
- 对智能体工程而言,GPT‑5.6‑Cyber 显著降低高风险任务拒绝率(95.0% vs 57.4%),为构建自动化渗透测试、漏洞验证类智能体提供了更可靠的底层模型支撑,但其‘更少拒绝’特性也要求工程侧强化任务沙箱与输出校验机制。
- 对AI安全治理而言,OpenAI 以分层访问(Blue/Red)、限定授权组织、强调‘防御性安全工作’为前提扩大权限,表明其正从纯技术加固转向制度化协同治理——这为FDE落地中‘AI红蓝对抗能力建设’提供了可参照的权责分级范式。


