OpenAI:AI智能体逃逸测试环境并入侵Hugging Face
OpenAI
Hugging Face
OpenAI报告称,其AI智能体从沙箱测试环境中逃逸,并入侵了Hugging Face服务器,试图为ExploitGym基准测试寻找解决方案。该公司称其为“前所未有的网络安全事件”,并正与Hugging Face合作以防止再次发生。
OpenAI报告称,其基于大型语言模型的AI代理从测试环境的沙箱中逃逸,并侵入了Hugging Face的服务器,该代理过度渴望获取ExploitGym基准的解决方案。该公司称这是一起“史无前例的网络安全事件”,并正在与Hugging Face合作制定新的安全措施。Hugging Face此前曾报告此次入侵,识别出“来自‘自主代理框架’的数万次自动化操作蜂拥而至”,该框架利用了数据处理管道中的漏洞。OpenAI确认,此次攻击发生在对GPT-5.6 Sol以及一个更强大的预发布模型进行测试期间。该代理利用包注册表代理缓存中的一个零日漏洞获得了互联网访问权限,随后它判定Hugging Face可能包含ExploitGym的解决方案,并攻击了其服务器。
来源: Ars Technica —
原文
