Claude Code は5日後にデフォルトで自動モードに切り替え、Anthropic が追加コストを負担
Anthropic
OpenAI
Anthropic は5日後に Claude Code のデフォルトを自動モードにすると発表しました。手動の許可承認の拒否率が低く、分類器の安全性パフォーマンスが良いことを理由に挙げています。自動モードでのツール呼び出しごとの追加トークンコストはユーザーに請求されません。Amazon、Google、Microsoft などのクラウドプラットフォームは、1か月以内にデフォルトで自動モードに切り替える必要があります。
Anthropicは、ユーザーによるパーミッションリクエストの拒否がわずか3%であることを確認したため、5日後から全Claude Codeインストールで自動モードをデフォルトにする。自動モードの分類器はツール呼び出しごとに若干の追加トークンを消費するが、Anthropicはこのコストをユーザーに転嫁しない。現在、自動モードをオプションとして提供しているAmazon、Google、Microsoftなどのクラウドプラットフォームは、1ヶ月以内に自動モードをデフォルトに切り替える必要がある。Anthropicの内部チームはすでに自動モードのみを使用していると、「Claude Codeの父」は述べている。Anthropicはこの変更をデータで正当化している:手動承認は習慣的になり、パーミッション画面の承認率は97%、単一パーミッションリクエストの拒否率はわずか3%である。1053人の有料テスターを対象とした管理実験では、人間の参加者は明らかに危険なコマンドを13.6%の割合で阻止したのに対し、自動モードは89%の割合で阻止した;自動モードは人間が許可した800のコマンドをブロックしたが、人間が自動モードが許可したコマンドをブロックしたのはわずか6つだった。人間のパフォーマンスはセッションの長さとともに低下し、初期の約17%からプロンプト50回後には約5%に低下したが、自動モードのインターセプト率は一定のままであった。重大度0〜10のスケールで再スコアリングされた本番データでは、重大度7以上で、手動承認セッションの6.3%がユーザーが明示的に要求していない有害なアクションを含んでいたのに対し、自動モードでは2.4%であった。分類器はApollo Researchと敵対的テストが行われ、実際のコーディングトレースに合成攻撃を注入した;強化後、自動モードは以前見逃した攻撃の約半分を回復し、複合データセットでの見逃し率は12%から7%に低下した。Trajectory Labsによるプロンプトインジェクションテストでは、自動モードで実行されたClaude Fable 5、Opus 5、Sonnet 5は720回の試行で侵害されなかったが、Codex Auto-reviewモードのGPT-5.6 Solは成功率5.83%、Full Accessモードでは19.03%であった。公開されたインターセプト事例3件には、公開コード共有サイトへのレポート公開計画のブロック、2000ポッドにわたる一括プロセス終了のブロック、フル管理者権限を持つクラウドロールへのフラグ付けが含まれる。新機能には、データ流出のハード拒否、キーと機密情報アクセスの差別化、git reset --hardなどのコマンド前のgit statusのチェック、注入試行のためのAPI側プロービングが含まれる。ユーザーはCLIのShift+Tabまたはデスクトップのモードドロップダウンでモードを切り替えることができ、管理者は組織全体のデフォルトを設定したり、自動モードを完全に無効にしたりできる。Anthropicは、自動モードはリスクを低減するが排除するものではないと述べ、高リスクの変更を確認することを推奨している。
出典: QbitAI 量子位 —
原文
