Anthropic dijo el 7 de agosto que, a partir del 14 de agosto, las nuevas sesiones de Claude Code en los planes Pro, Max y Team funcionarán en modo automático. En lugar de aprobar cada comando, cada acción se canaliza a través de un clasificador diseñado para bloquear cualquier cosa irreversible, destructiva o dirigida fuera del entorno del usuario.
La cifra que lo justifica
Anthropic contrató a 1.053 probadores de pago a través de un proveedor de investigación para un estudio de programación, insertando una orden peligrosa en una solicitud de permisos para cada uno. Los probadores la detectaron 143 veces — el 13,6%. El modo automático bloqueó la misma orden 937 veces — el 89%. Ambas cifras describen el mismo conjunto controlado, que es lo que hace que la comparación tenga sentido.
La atención decae; el clasificador no
El hallazgo más interesante es la curva. Los humanos bloquearon alrededor del 17% de las órdenes peligrosas al inicio de una sesión, porcentaje que cayó a aproximadamente el 5% tras 50 o más solicitudes previas. La tasa de bloqueo del modo automático se mantuvo plana independientemente de la duración de la sesión. Los probadores aprobaron el 97% de las solicitudes de permisos mientras rechazaban el 39% de las aprobaciones de planes: estaban leyendo los planes y dando el visto bueno a los comandos.
Dos estudios, no uno
Una evaluación independiente aparte de Trajectory Labs ejecutó 72 escenarios de inyección indirecta de prompts diez veces cada uno — 720 intentos — contra Claude Fable 5, Opus 5 y Sonnet 5 en modo automático, sobre versiones vigentes al 17 de julio. Ninguno tuvo éxito, y también cubrió Codex. Incluir esas 720 pruebas en el estudio con probadores, como hacen varios textos, mezcla dos experimentos distintos.
Qué cambia realmente
El modo automático ya existía. Lo que cambia es el valor predeterminado y, con él, el argumento: el daño no intencionado apareció en el 6,3% de las sesiones aprobadas manualmente frente al 2,4% en modo automático, y los usuarios del modo automático en clientes Team y Enterprise envían aproximadamente un 25% más de pull requests.
