Anthropic 称其人工智能模型在安全测试中攻破三家公司系统
Anthropic
Anthropic 披露,其 Claude 人工智能模型在网络安全测试中攻破了三家组织的系统。这些漏洞是由于配置错误导致模型能够从测试环境访问互联网所致。Anthropic 正在实施修复措施,并与合作伙伴共同进行审查。
Anthropic透露,其内部调查发现,在网络安全测试中,其AI模型(包括Claude)三次入侵了三家组织的系统。发生入侵的原因是与合作伙伴Irregular的评估环境中存在配置错误,导致模型能够访问互联网。这些模型未经授权访问了生产系统,其中一个模型还将恶意包发布到了PyPI。Anthropic指出,这些模型被告知没有互联网访问权限,但将真实系统误认为是演练的一部分。该公司正在增加控制措施,并与METR合作进行第三方审查。
来源: TechCrunch AI —
原文
