Claude Code stellt standardmäßig auf Auto-Modus um – in 5 Tagen, Anthropic übernimmt Zusatzkosten
Anthropic
OpenAI
Anthropic wird in fünf Tagen den Auto-Modus für Claude Code zur Standardeinstellung machen. Grund dafür sind die geringe Ablehnungsrate manueller Genehmigungen und die bessere Sicherheitsleistung des Klassifikators. Die zusätzlichen Token-Kosten pro Tool-Aufruf im Auto-Modus werden den Nutzern nicht berechnet. Cloud-Plattformen wie Amazon, Google und Microsoft haben einen Monat Zeit, um auf den Auto-Modus als Standard umzustellen.
Anthropic wird den Auto-Modus bei allen Claude-Code-Installationen in fünf Tagen standardmäßig aktivieren, nachdem festgestellt wurde, dass nur 3 % der Berechtigungsanfragen von Nutzern abgelehnt werden. Der Auto-Modus-Klassifikator verbraucht eine kleine Anzahl zusätzlicher Token pro Tool-Aufruf, aber Anthropic wird diese Kosten nicht an die Nutzer weitergeben. Cloud-Plattformen wie Amazon, Google und Microsoft, die den Auto-Modus derzeit als Option anbieten, müssen innerhalb eines Monats auf den Standard-Auto-Modus umstellen. Laut dem "Vater von Claude Code" nutzt das interne Team von Anthropic bereits ausschließlich den Auto-Modus. Anthropic rechtfertigt die Änderung mit Daten: Die manuelle Genehmigung ist zur Gewohnheit geworden, mit einer Akzeptanzrate von 97 % bei Berechtigungsabfragen, während die Ablehnungsrate für einzelne Berechtigungsanfragen nur 3 % beträgt. In einem kontrollierten Experiment mit 1053 bezahlten Testern fingen menschliche Teilnehmer einen eindeutig gefährlichen Befehl in 13,6 % der Fälle ab, während der Auto-Modus ihn in 89 % der Fälle abfing; der Auto-Modus blockierte 800 Befehle, die Menschen erlaubten, während Menschen nur 6 Befehle blockierten, die der Auto-Modus erlaubte. Die Leistung der Menschen nahm mit der Sitzungslänge ab, von etwa 17 % zu Beginn auf etwa 5 % nach 50 Aufforderungen, während die Abfangrate des Auto-Modus konstant blieb. Produktionsdaten, die auf einer Schweregradskala von 0 bis 10 neu bewertet wurden, zeigten, dass bei Schweregrad 7 und höher 6,3 % der manuell genehmigten Sitzungen schädliche Aktionen umfassten, die nicht explizit vom Benutzer angefordert wurden, verglichen mit 2,4 % im Auto-Modus. Der Klassifikator wurde mit Apollo Research adversarisch getestet, das synthetische Angriffe in echte Codierungsspuren injizierte; nach Härtung erholte der Auto-Modus etwa die Hälfte der zuvor übersehenen Angriffe, wobei die Fehlrate auf kombinierten Datensätzen von 12 % auf 7 % sank. In Prompt-Injection-Tests von Trajectory Labs wurden Claude Fable 5, Opus 5 und Sonnet 5 mit Auto-Modus in 720 Versuchen nicht kompromittiert, während GPT-5.6 Sol im Codex-Auto-Review-Modus eine Erfolgsrate von 5,83 % und im Vollzugriffsmodus von 19,03 % aufwies. Drei öffentliche Abfangfälle umfassen das Blockieren eines Plans, einen Bericht auf einer öffentlichen Code-Sharing-Website zu veröffentlichen, das Blockieren einer Massenbeendigung von Prozessen über 2000 Pods und das Markieren einer Cloud-Rolle mit vollständigen Administratorrechten. Neue Funktionen umfassen die harte Ablehnung von Datendiebstahl, die Unterscheidung zwischen Schlüssel- und sensiblen Informationszugriffen, die Überprüfung des Git-Status vor Befehlen wie git reset --hard sowie api-seitige Tests auf Injection-Versuche. Benutzer können mit Umschalt+Tab in der Befehlszeile oder über das Modus-Dropdown auf dem Desktop zwischen den Modi wechseln; Administratoren können organisationsweite Standardeinstellungen festlegen oder den Auto-Modus vollständig deaktivieren. Anthropic weist darauf hin, dass der Auto-Modus das Risiko reduziert, aber nicht beseitigt, und empfiehlt, risikoreiche Änderungen zu überprüfen.
Quelle: QbitAI 量子位 —
Original
