标签

OpenAI发布GPT-5.6-Cyber强化漏洞研究

发布时间:2026-08-11 18:18阅读:2

OpenAI进一步扩充了Daybreak项目,旨在让经过审核的安全专家能够深入使用前沿AI模型,新设两个访问级别——Daybreak Blue与Daybreak Red,并推出了一个专门用于漏洞验证、研究和红队演练的专用模型GPT-5.6-Cyber。

这一举措旨在填补攻击者与防御者之间的能力鸿沟。OpenAI警示称,威胁行为者正利用AI以空前的速度和规模发动网络攻击,甚至包括全自动化的操作。

Daybreak Blue主要面向防御者,提供对GPT-5.6 Sol的访问,并配备了针对授权安全任务(如漏洞挖掘、代码审计、恶意软件分析、应急响应和补丁测试)的专门防护机制。

Daybreak Red则权限更高,在更严格的管控下解锁了专精网络安全的模型,用于高阶漏洞探索、验证及安全测试。

Part01

OpenAI扩展Daybreak Cyber

Daybreak Red的核心是GPT-5.6-Cyber。该模型基于GPT-5.6 Sol打造,经过专项训练,旨在增强0Day漏洞发现和利用链构建能力,同时降低对合法但高风险的“双重用途”安全指令(例如在生产环境渗透测试)的拒绝率。

OpenAI内部的“高级网络安全完成率”基准用于评估模型在漏洞链开发、身份绕过和提权任务上的配合度。结果显示,GPT-5.6-Cyber的此类请求完成率高达95%,而普通版GPT-5.6 Sol仅有1.5%,Daybreak Blue下也只有2%。

相比上一代GPT-5.5-Cyber,提升显著——前者的同类请求完成率仅为57.3%。这也回应了安全研究人员长期以来的不满:模型在合法工作中拒绝请求过多。

除基准测试外,OpenAI利用GPT-5.6-Cyber对Chrome的V8 JavaScript引擎进行了调查,发现了两个未知漏洞,可链式利用造成内存破坏并逃逸V8堆沙箱。

这些漏洞已通过协同漏洞披露流程告知Google,并被修复为CVE-2026-15903。这是一个高危漏洞:V8优化编译器在整数转换时跳过安全检查,攻击者可借此在Chrome沙箱内执行任意代码。

据称,该模型还在某主流移动操作系统中发现了至少5个漏洞,在常用数据库中发现了3个严重缺陷,并在某流行操作系统内核中发现了400多个权限提升问题,相关披露正在进行。

Part02

模型能力与实测结果

根据OpenAI的“预备框架”,GPT-5.6 Sol和GPT-5.6-Cyber均被评定为达到“高”网络安全门槛,但仍未达到“严重”门槛。

OpenAI澄清,GPT-5.6-Cyber与此前披露的Hugging Face安全事件无关。为降低防护减弱带来的滥用风险,OpenAI将从2026年9月1日起强制所有Daybreak个人账户使用硬件安全密钥,推动Codex用户采用自动审查模式,并将在未来几周内加强监控。

Part03

安全与访问控制

Daybreak Blue和Daybreak Red的权限仅限经批准并从事授权安全工作的个人或组织,访问受身份验证、监控和法律声明约束。

OpenAI建议工作流进行沙箱隔离,严格限定权限范围,并对高风险任务保持人工监督。

包括SpecterOps在内的安全公司报告称效率大幅提升。SpecterOps首席技术官Jared Atkinson表示,该模型在不到一天内完成了以前需数周的专业漏洞研究工作。对Daybreak Red感兴趣的组织可通过OpenAI合作伙伴计划申请。

参考