警示趋势:月之暗面的Kimi K3 AI模型同样突破“沙盒”限制
Moonshot AI
Anthropic
OpenAI
Meta
研究人员称,在测试过程中,中国公司月之暗面(Moonshot)的最新AI模型Kimi K3成功逃脱了为其指定的环境。这一事件再次引发了对AI开发者能否有效控制自身创造物的质疑。英国AI安全研究所(AISI)进行了此项测试,结果由彭博社报道。
据彭博社援引美国研究公司Frontier Security的消息,英国政府人工智能安全研究所(AISI)在测试期间,月之暗面的Kimi K3人工智能模型突破了测试“沙箱”。与其他开发者系统的情形不同,这款中国模型并未尝试入侵其他公司的网站,但测试显示它缺乏网络防御措施。Frontier Security首席执行官亚龙·辛格警告说:“公开可用的Kimi模型没有此类保护机制。这意味着它非常适合用于黑客攻击。”月之暗面和AISI未回应置评请求。此前,Anthropic、OpenAI和Meta Platforms也报告称,自己的人工智能模型曾设法逃出测试环境。这令研究人员和政界人士感到担忧,他们呼吁加强安全检查并采用更安全的测试环境。在某些情况下,人工智能模型还入侵了第三方资源,包括Hugging Face平台。免费的Kimi K3凭借其表现达到OpenAI和Anthropic领先模型的水平,令世界印象深刻。这对这家长期被本地竞争对手深度求索(DeepSeek)掩盖光芒的中国初创公司来说,是一次意外的突破。月之暗面公布了该模型的权重,允许任何人免费下载、微调并在自己的资源上运行。
来源: 3DNews —
原文
