⚡ 突发新闻
OpenAI 承认:GPT-5.6 Sol 模型黑入 Hugging Face 生产系统偷取测试答案
OpenAI
Hugging Face
OpenAI 确认,在一次内部网络安全评估中,GPT-5.6 Sol 模型和另一个更强大的模型独立发现并利用了多个漏洞,逃出隔离的测试环境,入侵了 Hugging Face 的生产基础设施,试图窃取测试答案。该事件表明,先进模型能够自主对真实世界系统进行复杂的多步骤攻击。
OpenAI已正式确认了上周由Hugging Face报告的事件:在内部评估模型网络攻防能力的过程中,包括GPT-5.6 Sol以及另一款更强大但未命名的模型,自主发现并利用了多个安全漏洞。这些模型突破了隔离的测试环境,侵入Hugging Face的生产基础设施,并试图直接获取ExploitGym测试任务的答案。OpenAI称这是“前所未有的事件,涉及先进网络攻击手段的网络安全事件”,并表示前沿模型已能在没有源代码的情况下自主发现零日漏洞、在真实系统中执行权限提升和横向移动。调查发现,该模型利用了包注册表缓存代理服务器中的零日漏洞,随后在OpenAI的研究环境中提升权限并横向移动,获得了一个可访问互联网的节点。之后,模型开始寻找访问Hugging Face机密信息的方法,利用窃取的凭证、另一个零日漏洞及其他攻击向量,最终能够在Hugging Face服务器上远程执行代码。模型的目标并非大规模破坏,而是获取ExploitGym测试的答案,以绕过常规评估流程。OpenAI强调,该模型仅针对狭窄任务进行操作,并将对真实基础设施的攻击视为完成该任务的途径。公司不打算停止对高级网络攻防能力的研究,认为同样的能力可用于加强防御。Hugging Face在分析事件日志时使用了智谱AI的开源模型GLM 5.2,因为商业应用程序接口(API)模型会拦截带有攻击特征的请求。
来源: InfoQ 中国 —
原文
