OpenAI 推出 GPT-5.6-Cyber:新 AI 模型旨在帮助防御者在攻击者之前发现漏洞
OpenAI
OpenAI 扩展了其 Daybreak 网络安全计划,新增两个访问层级和新 AI 模型 GPT-5.6-Cyber,以帮助防御者尽早发现漏洞并开发利用程序。该计划现包括用于防御任务的 Daybreak Blue 和用于进攻性安全研究的 Daybreak Red,其中 GPT-5.6-Cyber 通过 Red 层级提供,能回答 95% 的敏感安全查询。
OpenAI正在扩展其Daybreak项目,推出两个访问层级和一个名为GPT-5.6-Cyber的新专用模型,旨在帮助防御者在攻击者大规模部署AI驱动的进攻性工具之前,发现漏洞并开发漏洞利用程序。据OpenAI称,威胁行为者将越来越多地使用AI进行网络攻击,包括完全自主的形式,从而缩短防御者的准备时间窗口。一个例子是OpenAI无意中让其模型入侵了Hugging Face和其他服务。Daybreak Blue提供对GPT-5.6 Sol的访问,并针对授权的防御性工作(如漏洞检测、恶意软件分析和事件响应)调整了防护措施。Daybreak Red面向进行漏洞研究、漏洞利用验证和渗透测试的安全研究人员。两个层级的访问都需要身份验证、账户安全、监控和法律声明。自2026年9月1日起,所有Daybreak账户将强制要求使用硬件安全密钥。OpenAI还建议在隔离的沙盒环境中运行安全工作流,并使用Codex中的自动审查模式。GPT-5.6-Cyber基于GPT-5.6 Sol,可通过Red层级获取,在名为“高级网络安全完成率”的内部基准测试中回答了95%的查询,该测试涵盖漏洞利用链开发、身份验证绕过和权限提升等场景。相比之下,带有防护措施的GPT-5.6 Sol仅达到1.5%,Daybreak Blue为2%,而前代GPT-5.5-Cyber为57.3%。在一个具体测试中,只有通过Daybreak Red访问的GPT-5.6-Cyber生成了针对WebSocket身份验证绕过的功能性漏洞利用代码,而其他变体则拒绝了。在ExploitGym上,GPT-5.6-Cyber的表现优于GPT-5.6 Sol和GPT-5.5-Cyber。OpenAI使用GPT-5.6-Cyber进行了实际漏洞研究,发现了Chrome的V8 JavaScript引擎中两个此前未知的漏洞,这些漏洞可以被链接起来导致内存损坏并绕过V8堆沙盒;谷歌已将其修复为CVE-2026-15903。此外,GPT-5.6-Cyber在一个“流行的移动操作系统”中发现了至少五个漏洞,包括一个可以将应用权限提升至管理员权限的漏洞链。OpenAI与Daybreak合作伙伴和开源社区就披露事宜进行合作。根据OpenAI的准备框架,GPT-5.6-Cyber的网络安全能力被评为“高”,未达到Astra模型可能实现的“严重”阈值。
来源: The Decoder (DE) —
原文
