据 Help Net Security 8 月 11 日报道,OpenAI 发布了 GPT-5.6-Cyber,一个建立在 GPT-5.6 Sol 之上、专门针对漏洞挖掘与利用链构造做过训练的模型。OpenAI 自建了一套内部基准,统计模型面对利用链、身份验证绕过、权限提升这类请求时的接受情况:GPT-5.6-Cyber 完成了其中 95%,而开着防护策略的标准版 GPT-5.6 只有 1.5%。差别主要不在能力,在于拒答边界被有意放开了。
分发方式才是这次的重点。模型不进公开 API,只通过 Daybreak Red 发放——那是 OpenAI 面向安全从业者的审核准入计划里权限更高的一层。按 OpenAI 的 Preparedness 框架,GPT-5.6 Sol 在网络安全维度被评为 High、低于 Critical 阈值,GPT-5.6-Cyber 的评估结论相同。OpenAI 同时公布了成果:用它找到两个此前未公开的 V8 引擎缺陷,串起来可造成内存破坏并逃出沙箱,谷歌已以 CVE-2026-15903 修复。发布时间距 OpenAI 因担心 Astra 触及最高一档攻击能力而暂缓其发布,只隔了几天。
这条新闻对多数人的价值不在「能不能用上」——Daybreak Red 的名额本来就拿不到——而在于它给出一个明确信号:拒答策略正在被从模型能力里单独拆出来管控和定价。如果你负责安全评测或漏洞响应流程,可以据此重新估算攻击侧工具的进展速度。反过来看,模型既然不对外开放,95% 这个数字外界就无法复现,公布的漏洞战果目前也只有一方叙述,不宜当成已验证的能力上限来用。