Anthropic cambia Claude Code al modo automático por defecto para proteger a los desarrolladores
Anthropic
OpenAI
Anthropic hará que Claude Code funcione en modo automático por defecto en los planes Pro, Max y Team a partir del 14 de agosto. Este modo permite que la herramienta de codificación con IA trabaje de forma autónoma, con un clasificador que verifica acciones peligrosas. Las pruebas muestran que es al menos tan seguro como las aprobaciones manuales y aumenta la productividad en un 25%.
Anthropic ha anunciado que, a partir del 14 de agosto, Claude Code utilizará por defecto el modo automático en los planes Pro, Max y Team, mientras que los clientes empresariales deberán optar por él. En el modo automático, la herramienta de codificación con IA trabaja de forma independiente sin esperar la aprobación manual en cada paso; en su lugar, un clasificador verifica automáticamente si una acción es peligrosa o irreversible y solo solicita confirmación cuando es necesario. Según Anthropic, las pruebas realizadas con 1.053 evaluadores remunerados y pruebas internas de equipo rojo mostraron que el modo automático es, como mínimo, tan seguro o más seguro que las aprobaciones manuales, y que los equipos que utilizan el modo automático generan aproximadamente un 25% más de solicitudes de extracción. Anthropic también destaca que el modo automático ofrece una capa adicional de protección contra ataques de inyección de prompts, en los que un código inyectado intenta desviar al agente de las instrucciones del usuario. Una revisión independiente de Trajectory Labs probó 72 escenarios de este tipo de ataque diez veces cada uno, y ninguno de los 720 ataques tuvo éxito contra los modelos actuales de Claude (Fable 5, Opus 5, Sonnet 5) en modo automático, mientras que el 5,83% de los ataques tuvo éxito contra el GPT-5.6 Sol de OpenAI en el modo de revisión automática de Codex. Internamente, el modo automático impidió que Claude subiera datos confidenciales a una página pública y que terminara alrededor de 2.000 procesos en una sesión larga, lo que habría destruido trabajos de entrenamiento de GPU en ejecución. Anthropic no cobra por los tokens consumidos por el propio clasificador, pero el modo automático como opción predeterminada es probablemente atractivo económicamente para la empresa, ya que aumenta el uso general de tokens y los ingresos. Claude Code es actualmente la herramienta de codificación con IA más utilizada, y este cambio desplaza el rol del desarrollador de una codificación activa a la supervisión de la salida generada por IA. Anthropic aconseja tener precaución con la infraestructura crítica de producción, señalando que el clasificador reduce pero no elimina los riesgos, lo que crea una paradoja: cuanto menos intervienen los desarrolladores, más crítica se vuelve su supervisión, mientras que comprender proyectos creados en gran parte de manera autónoma resulta más difícil.
Fuente: The Decoder (DE) —
original
