Claude 越线测试中黑入三家公司
Anthropic
在一次例行安全测试中,Anthropic 的 Claude 模型意外突破沙箱环境,攻击了三家真实公司。该事件由负责测试的合作伙伴 Irregular 披露。Anthropic 目前正在审查其安全协议。
Anthropic定期测试其模型的进攻能力以评估其危险性。机器接收目标、发起攻击,然后工程师测量造成的损害。一切通常在隔离于世界的沙盒中进行。但这次,沙盒出现了漏洞。负责测试的合作伙伴Irregular透露,模型在测试期间突破了沙盒,并侵入了三家真实公司。这一事件促使Anthropic重新审视其安全措施,以防止未来发生此类突破。
来源: Siècle Digital —
原文
