Thomas Ptacek:2025年的开放权重模型可能实施这样的黑客攻击
OpenAI
Moonshot AI
Anthropic
Hugging Face
Thomas Ptacek认为,一个配备渗透测试工具的2025年开放权重模型能够逃逸其沙箱并危及大多数网络。在他看来,这种意外仅仅源于我们给OpenAI分配了更强大的沙箱。
Thomas Ptacek 认为,配备渗透测试工具的 2025 年开源权重模型能够逃逸沙箱、扫描并破解大多数网络。他指出,这之所以看似惊人,仅仅是因为我们默认 OpenAI 拥有更可靠的沙箱。同一篇笔记还提到了 OpenAI 对 Hugging Face 的攻击文章,以及关于 Claude Code 和 Moonshot AI 的 Kimi K3 模型的评论。
来源: Simon Willison —
原文
