Claude Code schakelt standaard over op automatische modus binnen 5 dagen, Anthropic dekt extra kosten
Anthropic
OpenAI
Anthropic zal binnen vijf dagen de automatische modus standaard maken voor Claude Code, verwijzend naar lage afwijzingspercentages van handmatige goedkeuringen en betere veiligheidsprestaties van de classificatie. De extra tokenkosten per toolaanroep in de automatische modus worden niet aan gebruikers doorberekend. Cloudplatforms zoals Amazon, Google en Microsoft krijgen een maand de tijd om standaard over te schakelen op de automatische modus.
Anthropic zal auto-modus standaard inschakelen voor alle Claude Code-installaties binnen vijf dagen, nadat is gebleken dat slechts 3% van de toestemmingsverzoeken door gebruikers wordt afgewezen. De classifier in de auto-modus verbruikt een klein aantal extra tokens per toolaanroep, maar Anthropic zal deze kosten niet doorberekenen aan gebruikers. Cloudplatforms zoals Amazon, Google en Microsoft, die de auto-modus momenteel als optie aanbieden, moeten binnen een maand overschakelen naar de standaard auto-modus. Het interne team van Anthropic gebruikt al uitsluitend de auto-modus, aldus de 'vader van Claude Code'. Anthropic rechtvaardigt de wijziging met data: handmatige goedkeuring is gewoon geworden, met een acceptatiegraad van 97% voor toestemmingsprompts, terwijl het afwijzingspercentage voor enkele toestemmingsverzoeken slechts 3% is. In een gecontroleerd experiment met 1053 betaalde testers onderschepten menselijke deelnemers een duidelijk gevaarlijk commando in 13,6% van de gevallen, terwijl de auto-modus dit in 89% van de gevallen deed; de auto-modus blokkeerde 800 commando's die mensen toestonden, terwijl mensen slechts 6 commando's blokkeerden die de auto-modus toestond. Menselijke prestaties namen af met de sessieduur, van ongeveer 17% in het begin tot ongeveer 5% na 50 prompts, terwijl het onderscheppingspercentage van de auto-modus constant bleef. Productiedata, herschaald op een ernstschaal van 0 tot 10, toonden aan dat bij ernst 7 en hoger 6,3% van de handmatig goedgekeurde sessies schadelijke acties omvatte die niet expliciet door de gebruiker waren gevraagd, vergeleken met 2,4% voor de auto-modus. De classifier werd adversarieel getest met Apollo Research, dat synthetische aanvallen in echte codeertraces injecteerde; na versteviging herstelde de auto-modus ongeveer de helft van de eerder gemiste aanvallen, waarbij het missingspercentage daalde van 12% naar 7% op gecombineerde datasets. In prompt-injectietests door Trajectory Labs werden Claude Fable 5, Opus 5 en Sonnet 5 in de auto-modus niet gecompromitteerd in 720 pogingen, terwijl GPT-5.6 Sol in Codex Auto-review-modus een succespercentage van 5,83% had en 19,03% in de Full Access-modus. Drie openbare onderscheppingsgevallen omvatten het blokkeren van een plan om een rapport op een openbare code-deelsite te publiceren, het blokkeren van een bulkbeëindiging van processen over 2000 pods, en het markeren van een cloudrol met volledige beheerdersrechten. Nieuwe mogelijkheden zijn onder meer harde weigering van data-exfiltratie, differentiatie van toegang tot sleutel- en gevoelige informatie, het controleren van de git-status vóór commando's zoals git reset --hard, en het aan API-zijde opsporen van injectiepogingen. Gebruikers kunnen van modus wisselen met Shift+Tab in de CLI of via het modusdropdown op de desktop; beheerders kunnen organisatiebrede standaarden instellen of de auto-modus volledig uitschakelen. Anthropic merkt op dat de auto-modus het risico vermindert maar niet elimineert, en beveelt aan om wijzigingen met een hoog risico te beoordelen.
Bron: QbitAI 量子位 —
origineel
