Auto-modus wordt standaard in Claude Code voor Pro-, Max- en Team-abonnementen
Anthropic
Anthropic maakt de automatische modus van Claude Code vanaf 14 augustus de standaard voor nieuwe sessies in de meeste abonnementen. Het bedrijf claimt uitgebreide veiligheidsverbeteringen, ondersteund door evaluaties die aantonen dat de automatische modus 89 procent van de schadelijke acties blokkeert die mensen vaak goedkeuren. Onafhankelijke verificatie is echter nog steeds nodig, met name voor indirecte prompt-injectieaanvallen.
Anthropic heeft vertrouwen in de automatische modus van Claude Code en maakt dit vanaf 14 augustus 2026 de standaard voor nieuwe sessies in de Pro-, Max- en Team-abonnementen. Tijdens een Fireside Chat op de AI Engineer World's Fair bespraken Cat Wu en Thariq Shihipar hoe Anthropic Claude Code veilig laat draaien. Ze merkten op dat bijna iedereen intern de automatische modus gebruikt en dat ze grote risico's zoals promptinjectie en datadiefstal hebben beperkt. Anthropic publiceerde evaluaties van een test met 1.053 betaalde testers, waarbij een gevaarlijke opdracht in een sessie werd verwisseld; slechts 13,6% van de mensen weigerde, terwijl de automatische modus 89% van die acties zou hebben geblokkeerd. Anthropic liet ook een evaluatie uitvoeren door Trajectory Labs, die 72 indirecte promptinjectiescenario's testte tegen Claude Code en Codex. Hierbij waren er nul succesvolle aanvallen tegen Claude Fable 5, Opus 5 of Sonnet 5 in de automatische modus. De auteur, Simon Willison, erkent dat de automatische modus beter kan zijn dan menselijke goedkeuring vanwege bevestigingsmoeheid, maar hij maakt zich zorgen over indirecte promptinjectie via kwaadaardige pakketten, zoals een testinstructie die een kwaadaardig hulpmiddel uitvoert om gegevens te exfiltreren. Hij roept op tot onafhankelijke bevestiging en suggereert om agents te laten draaien met beperkte toegang tot gegevens en hulpmiddelen.
Bron: Simon Willison —
origineel
