AgentsSécurité de l'IA 🇺🇸 09.08.2026 02:02

Le mode automatique devient la valeur par défaut dans Claude Code pour les formules Pro, Max et Team

AnthropicAnthropic
Anthropic rend le mode automatique de Claude Code par défaut pour les nouvelles sessions dans la plupart des formules à partir du 14 août. L'entreprise affirme avoir réalisé des améliorations importantes en matière de sécurité, appuyées par des évaluations montrant que le mode automatique bloque 89 % des actions nuisibles que les humains approuvent souvent. Cependant, une vérification indépendante reste nécessaire, notamment en ce qui concerne les attaques par injection indirecte de prompts.
Anthropic est confiant dans le mode automatique de Claude Code, au point d'en faire le mode par défaut pour les nouvelles sessions des formules Pro, Max et Team à partir du 14 août 2026. Lors d'une discussion en ligne à la Foire mondiale des ingénieurs en IA, Cat Wu et Thariq Shihipar ont expliqué comment Anthropic fait fonctionner Claude Code en toute sécurité, notant que presque tous les employés utilisent le mode automatique en interne et que les risques majeurs comme l'injection de prompts et l'exfiltration de données ont été atténués. Anthropic a publié les résultats d'évaluations menées avec 1 053 testeurs rémunérés, où une commande dangereuse a été insérée dans une session ; seuls 13,6 % des humains ont refusé, tandis que le mode automatique aurait bloqué 89 % de ces actions. Anthropic a également commandé une évaluation à Trajectory Labs, qui a testé 72 scénarios d'injection indirecte de prompts contre Claude Code et Codex, sans trouver aucune attaque réussie contre Claude Fable 5, Opus 5 ou Sonnet 5 en mode automatique. L'auteur, Simon Willison, reconnaît que le mode automatique peut être préférable à l'approbation humaine en raison de la fatigue liée aux confirmations, mais il s'inquiète des injections indirectes de prompts via des paquets malveillants, comme une instruction de test qui exécute un outil malveillant pour exfiltrer des données. Il appelle à une vérification indépendante et suggère de faire fonctionner les agents avec un accès restreint aux données et aux outils.
Source: Simon Willison — original
Nos articles précédents sur ce sujet ↓
Infos fraîches