Anthropic 将 Claude Code 默认切换为自动模式,以保护开发者
Anthropic
OpenAI
自 8 月 14 日起,Anthropic 将让 Claude Code 在专业版、Max 版和团队版中默认以自动模式运行。该模式允许 AI 编码工具自主工作,并通过分类器检查危险操作。测试显示,其安全性至少与手动审批相当,且生产力提高了 25%。
Anthropic宣布,从8月14日起,Claude Code将对Pro、Max和Team计划默认启用自动模式,而企业客户则需主动选择加入。在自动模式下,这款AI编码工具无需在每一步等待人工批准即可独立工作;相反,一个分类器会自动检查某项操作是否危险或不可逆,仅在必要时请求确认。据Anthropic称,对1053名付费测试者进行的测试及内部红队演练显示,自动模式至少与人工审批一样安全,甚至更安全,且使用自动模式的团队创建的拉取请求数量约多25%。Anthropic还强调,自动模式针对提示注入攻击提供了额外一层防护,这类攻击通过注入代码试图将代理从用户的指令中引开。独立审查机构Trajectory Labs对72种此类攻击场景各测试了10次,结果在自动模式下,针对Claude当前模型(Fable 5、Opus 5、Sonnet 5)的720次攻击无一成功,而对OpenAI的GPT-5.6 Sol在Codex自动审查模式下进行的攻击则有5.83%成功。在内部测试中,自动模式阻止了Claude将机密数据上传到公共页面,并防止其在一次长会话中终止约2000个进程,这些进程本会破坏正在运行的GPU训练任务。Anthropic不对分类器本身消耗的Token收费,但默认启用自动模式对该公司在经济上可能颇具吸引力,因为这增加了整体Token使用量和收入。Claude Code目前是使用最广泛的AI编码工具,这一转变将开发者的角色从主动编码转变为监控AI生成的输出。Anthropic建议对生产关键型基础设施保持谨慎,指出分类器能降低风险但不能完全消除风险,这产生了一个悖论:开发者干预越少,他们的控制越关键,而理解主要由AI自主创建的项目则变得更加困难。
来源: The Decoder (DE) —
原文
