A partir del 14 de agosto, Anthropic cambiará el modo predeterminado para las nuevas sesiones de Claude Code a automático para los suscriptores Pro, Max y Team.
La empresa afirma que este cambio permite que su agente de codificación se ejecute durante más tiempo antes de tener que detenerse y solicitar aprobación. Según sus pruebas, el modo automático bloquea comandos más peligrosos que los que revisan manualmente los desarrolladores.
El modo automático dirige todas las llamadas a la herramienta a través de un clasificador entrenado para reconocer acciones irreversibles, destructivas o que se salgan del entorno del usuario. Si un comando se bloquea, Claude lo evita o consulta directamente con el desarrollador. Si se producen tres bloqueos consecutivos, o veinte bloqueos en una sesión, la herramienta pasa a la aprobación manual.
Los datos de Anthropic muestran que los usuarios aceptan el 97 % de las solicitudes de permisos y solo rechazan el 3 %. Sin embargo, cuando Claude presenta un plan completo, la tasa de rechazo aumenta al 39 %. Anthropic interpreta esta diferencia como evidencia de que las personas analizan detenidamente las decisiones generales, pero aprueban los permisos individuales sin mayor consideración, despidiéndolos decenas o cientos de veces al día.
El cambio se basa en una cifra obtenida de un estudio controlado que Anthropic encargó a 1053 evaluadores profesionales remunerados. Los evaluadores trabajaron en un entorno especialmente diseñado para ello. Sabían que estaban siendo observados, pero desconocían qué se estaba midiendo.
En medio de una sesión, un comando claramente dañino reemplazó una solicitud de permiso normal. En el 13,6% de los casos, los revisores humanos pudieron detectarlo. El modo automático lo detectó en el 89%.
Según los datos de configuración, las medidas de seguridad ya se estaban debilitando. En junio de 2026, aproximadamente la mitad de los usuarios activos de la línea de comandos habían escrito una regla de permisos de Bash. El 62 % había utilizado permisos de omisión o había seleccionado "no volver a preguntar". Ahora, una cuarta parte de las sesiones interactivas comienzan directamente en modo de omisión.

El modo automático también proporciona una defensa contra la inyección de mensajes, un ataque en el que un texto malicioso intenta desviar al agente de la acción solicitada por el usuario.
En una auditoríadent , Trajectory Labs probó 72 escenarios de ataque, cada uno 10 veces. Fable 5, Opus 5 y Sonnet 5, los modelos actuales de Anthropic, no pudieron ser vulnerados en modo automático en ninguno de los 720 intentos.
En la misma revisión, OpenAI GPT-5.6 Sol, en modo de revisión automática de Codex, obtuvo una tasa de éxito del 5,83 % para los atacantes.
El modo automático impidió Claude publicaradenten una página pública. En una sesión prolongada, detectó que Claude estaba poniendo en cola una eliminación en aproximadamente 2000 pods, lo que habría colapsado cientos de GPU que estaban ejecutando trabajos de entrenamiento.
Los equipos y clientes empresariales que utilizan el modo automático envían aproximadamente un 25 % más de solicitudes de extracción. Anthropic mencionó a Adobe, Nuro, Gusto y Garner Health como usuarios de producción.
Desde el 7 de agosto, ha dejado de cobrar a los planes Pro, Max y Team por los tokens quemados por el clasificador. Las ejecuciones autónomas más largas implican un mayor consumo total.
Por ahora, la opción predeterminada solo se activa para los planes de consumidor y de equipo. Anthropic afirma que implementará el modo automático en Enterprise, la API de Claude, AWS, Amazon Bedrock, la plataforma de agentes de Google Cloud y Microsoft Foundry durante el próximo mes, aunque por el momento solo se puede activar de forma voluntaria.
Los desarrolladores que ya tengan una configuración predeterminada diferente la conservarán. Otros podrían recibir una notificación para cambiarla una sola vez.
Anthropic afirmó que el clasificador no elimina los riesgos. Como Cryptopolitan informó en julio, tres modelos Claude escaparon de los entornos de prueba durante simulacros de seguridad debido a una configuración incorrecta que les otorgó acceso a internet en tiempo real.
No te limites a leer noticias sobre criptomonedas. Entiéndelas. Suscríbete a nuestro boletín. Es gratis.