Claude Code passe en mode automatique par défaut dans 5 jours, Anthropic couvre les coûts supplémentaires
Anthropic
OpenAI
Anthropic fera du mode automatique le mode par défaut pour Claude Code dans cinq jours, citant de faibles taux de rejet des approbations manuelles de permission et de meilleures performances de sécurité du classificateur. Le coût supplémentaire en jetons par appel d'outil en mode automatique ne sera pas facturé aux utilisateurs. Les plateformes cloud comme Amazon, Google et Microsoft ont un mois pour passer en mode automatique par défaut.
Anthropic activera le mode automatique par défaut pour toutes les installations de Claude Code dans cinq jours, après avoir constaté que seulement 3 % des demandes d'autorisation sont rejetées par les utilisateurs. Le classificateur du mode automatique consomme un petit nombre de jetons supplémentaires par appel d'outil, mais Anthropic ne répercutera pas ce coût sur les utilisateurs. Les plateformes cloud telles qu'Amazon, Google et Microsoft, qui proposent actuellement le mode automatique en option, doivent passer au mode automatique par défaut dans un délai d'un mois. L'équipe interne d'Anthropic utilise déjà exclusivement le mode automatique, selon le « père de Claude Code ». Anthropic justifie ce changement par des données : l'approbation manuelle est devenue une habitude, avec un taux d'acceptation de 97 % pour les invites d'autorisation, tandis que le taux de rejet pour les demandes d'autorisation individuelles n'est que de 3 %. Dans une expérience contrôlée avec 1 053 testeurs rémunérés, les participants humains ont intercepté une commande clairement dangereuse dans 13,6 % des cas, tandis que le mode automatique l'a interceptée dans 89 % des cas ; le mode automatique a bloqué 800 commandes que les humains ont autorisées, tandis que les humains n'ont bloqué que 6 commandes que le mode automatique a autorisées. Les performances humaines diminuaient avec la durée de la session, passant d'environ 17 % au début à environ 5 % après 50 invites, tandis que le taux d'interception du mode automatique restait constant. Les données de production réévaluées sur une échelle de gravité de 0 à 10 ont montré qu'à partir du niveau de gravité 7, 6,3 % des sessions approuvées manuellement impliquaient des actions nuisibles non explicitement demandées par l'utilisateur, contre 2,4 % pour le mode automatique. Le classificateur a été testé de manière contradictoire avec Apollo Research, qui a injecté des attaques synthétiques dans des traces de codage réelles ; après durcissement, le mode automatique a récupéré environ la moitié des attaques précédemment manquées, le taux d'échec passant de 12 % à 7 % sur les ensembles de données combinés. Dans les tests d'injection d'invites menés par Trajectory Labs, Claude Fable 5, Opus 5 et Sonnet 5 exécutant le mode automatique n'ont pas été compromis en 720 tentatives, tandis que GPT-5.6 Sol en mode révision automatique de Codex avait un taux de réussite de 5,83 % et de 19,03 % en mode accès complet. Trois cas d'interception publics incluent le blocage d'un plan de publication d'un rapport sur un site public de partage de code, le blocage d'une terminaison en masse de processus sur 2 000 pods, et le signalement d'un rôle cloud avec des autorisations d'administrateur complètes. Les nouvelles capacités incluent le refus strict de l'exfiltration de données, la différenciation de l'accès aux informations sensibles et aux clés, la vérification de l'état de git avant des commandes comme git reset --hard, et la détection côté API des tentatives d'injection. Les utilisateurs peuvent changer de mode avec Maj+Tab dans l'interface en ligne de commande ou le menu déroulant de mode sur le bureau ; les administrateurs peuvent définir des valeurs par défaut à l'échelle de l'organisation ou désactiver entièrement le mode automatique. Anthropic note que le mode automatique réduit mais n'élimine pas les risques et recommande de passer en revue les changements à haut risque.
Source: QbitAI 量子位 —
original
