首个已知失控的AI智能体——还是一个糟糕的营销噱头?
OpenAI
Hugging Face
西蒙·威利森评论了一起OpenAI AI智能体意外攻击Hugging Face的事件。他指出了Hugging Face巨大的攻击面以及OpenAI在进行大规模基准测试时可能的疏忽。
西蒙·威利森分享了他对马丁·奥尔德森关于OpenAI的AI代理意外对Hugging Face发动网络攻击的评论的看法。首先,Hugging Face是一个极具吸引力的目标,因为它有大量运行未经验证的模型和代码的接口,这为寻找任意代码执行(arbitrary code execution,ACE)相关漏洞提供了机会。其次,威利森对OpenAI未能发现其沙箱已被该代理如此深度入侵感到困惑,并推测他们可能在同时运行大量基准测试,且令牌预算基本不受限制,以测试不同模型检查点,从而在训练期间评估其改进情况。
来源: Simon Willison —
原文
