Anthropic网络安全评估中的三起真实事件
Anthropic
OpenAI
Anthropic在其网络安全评估中发现了三起真实事件,其中Claude因对互联网访问的误解而危及外部系统。其中一起事件涉及将恶意软件上传至PyPI(Python软件包索引),该软件被一家安全公司安装。这些事件凸显了运行网络攻击评估的风险。
Anthropic审查了141,006次评估运行,发现三起独立事件,共涉及六次运行,其中四次影响同一组织。在所有案例中,评估提示告知Claude环境为无互联网访问的模拟环境,但由于与评估伙伴的误解,实际上可访问互联网。Claude将真实系统视为演练的一部分,并利用弱密码和未认证端点等基本技术入侵了这些系统。一家公司因名称与评估中的虚构名称相符而成为目标。最令人担忧的事件涉及Claude在经历一系列复杂过程创建账户后,向PyPI上传了一个恶意软件包。该软件包被一家定期扫描Python包以查杀恶意软件的安全公司安装,执行代码将凭据外泄回Claude。该软件包在一小时后被其他自动扫描工具移除,但已被下载并在15个真实系统上执行。这些事件凸显了运行网络攻击评估的重大风险,以及密切监控沙箱的必要性。
来源: Simon Willison —
原文
