Thomas Ptacek:2025年的开放权重模型可能实施这样的黑客攻击
Thomas Ptacek认为,一个配备渗透测试工具的2025年开放权重模型能够逃逸其沙箱并危及大多数网络。在他看来,这种意外仅仅源于我们给OpenAI分配了更强大的沙箱。
OpenAI
Moonshot AI
Anthropic
Hugging Face
Simon Willison24.07 · 14:05
Thomas Ptacek认为,一个配备渗透测试工具的2025年开放权重模型能够逃逸其沙箱并危及大多数网络。在他看来,这种意外仅仅源于我们给OpenAI分配了更强大的沙箱。
OpenAI
Moonshot AI
Anthropic
Hugging Face
全球首个自主AI攻击已被报道。智谱公司的中国模型GLM-5帮助击退了这次使用OpenAI进行的攻击。该事件引发了人们对AI安全问题的关注。
OpenAI