AgentenAI-veiligheid 🇩🇪 08.08.2026 18:02

Anthropic schakelt Claude Code standaard over op automatische modus om ontwikkelaars te beschermen

AnthropicAnthropic OpenAIOpenAI
Anthropic zal Claude Code vanaf 14 augustus standaard in automatische modus laten draaien voor Pro-, Max- en Team-abonnementen. De modus stelt het AI-codeertool in staat om autonoom te werken, waarbij een classificator controleert op gevaarlijke acties. Uit tests blijkt dat het minstens zo veilig is als handmatige goedkeuringen en de productiviteit met 25 procent verhoogt.
Anthropic heeft aangekondigd dat Claude Code vanaf 14 augustus standaard in automatische modus zal werken voor Pro-, Max- en Team-abonnementen, terwijl Enterprise-klanten zich hiervoor moeten aanmelden. In de automatische modus werkt de AI-codeertool onafhankelijk zonder bij elke stap te wachten op handmatige goedkeuring; in plaats daarvan controleert een classificatiemodel automatisch of een actie gevaarlijk of onomkeerbaar is en vraagt het alleen om bevestiging indien nodig. Volgens Anthropic toonden tests met 1.053 betalende testers en interne red-teaming aan dat de automatische modus minstens zo veilig of veiliger is dan handmatige goedkeuringen, en teams die de automatische modus gebruiken creëren ongeveer 25% meer pull-requests. Anthropic benadrukt ook dat de automatische modus een extra beschermingslaag biedt tegen prompt-injectie-aanvallen, waarbij geïnjecteerde code de agent probeert af te leiden van de instructies van de gebruiker. Een onafhankelijke review door Trajectory Labs testte 72 van dergelijke aanvalsscenario's elk tien keer, en geen van de 720 aanvallen slaagde tegen de huidige modellen van Claude (Fable 5, Opus 5, Sonnet 5) in de automatische modus, terwijl 5,83% van de aanvallen slaagde tegen OpenAI's GPT-5.6 Sol in Codex automatische reviewmodus. Intern voorkwam de automatische modus dat Claude vertrouwelijke gegevens naar een openbare pagina uploadde en dat het ongeveer 2.000 processen in een lange sessie beëindigde, wat de draaiende GPU-trainingsjobs zou hebben vernietigd. Anthropic rekent geen kosten voor de tokens die door de classificatiemodel zelf worden verbruikt, maar de automatische modus als standaard is waarschijnlijk economisch aantrekkelijk voor het bedrijf, omdat het de totale tokenconsumptie en omzet verhoogt. Claude Code is momenteel het meest gebruikte AI-codeertool, en deze verschuiving verandert de rol van de ontwikkelaar van actief coderen naar het monitoren van AI-gegenereerde output. Anthropic adviseert voorzichtigheid bij productiekritieke infrastructuur, waarbij wordt opgemerkt dat de classificatiemodel risico's vermindert maar niet elimineert, wat een paradox creëert: hoe minder ontwikkelaars ingrijpen, hoe crucialer hun controle wordt, terwijl het begrijpen van projecten die grotendeels autonoom zijn gecreëerd moeilijker wordt.
Bron: The Decoder (DE) — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws