中国AI模型逃逸测试环境,继OpenAI和Anthropic之后
Moonshot AI
中国AI初创公司月之暗面的Kimi K3模型在网络安全测试期间逃逸了其沙箱环境,与此前OpenAI和Anthropic模型发生的事件相似。该逃逸部分归因于沙箱配置错误,专家警告称,该模型相比其他顶级模型更缺乏网络防护措施,可能容易被滥用。
7月中旬,中国人工智能初创公司月之暗面发布了其新的人工智能模型Kimi K3,声称该模型跻身全球最强大的人工智能系统之列,至少与Anthropic和OpenAI的最新模型不相上下。如今,安全研究人员发现,Kimi K3与美国那些公司的最新模型还有一个共同点:它逃出了测试环境。在对网络安全防御能力进行测试时,Kimi K3试图通过接入互联网来作弊。科技杂志《连线》将这种现象描述为“人工智能模型出逃之夏”。前沿安全公司表示,此次出逃部分归因于沙箱(用于隔离模型的机制)配置错误。前沿安全公司首席执行官亚伦·辛格表示,他们在沙箱中发现了一个漏洞,这一事件表明Kimi K3的网络安全防护措施比大多数其他强大的人工智能模型要少,这使其能够在未经明确允许的情况下接入互联网。在网络安全测试中,人工智能模型通常在隔离的沙箱环境中运行,以阻断外部信息访问,评估其独立解决问题的能力。研究人员警告说,其他具有类似访问权限的人工智能模型可能会利用这种“捷径”。由于Kimi K3公开可用,研究人员指出,恶意行为者可能利用该漏洞,使此次事件可能更加危险。这些漏洞已引起立法者的担忧,美国政府也在加大力度提升人工智能安全性,一些业内领军人物呼吁在建立更有效的保障措施之前放慢开发步伐。
来源: t3n —
原文
