Anthropic anunció que el modo automático de Claude Code pasará a ser el estándar para las nuevas sesiones en los planes Pro, Max y Team a partir del 14 de agosto. La empresa afirma que la decisión busca reducir fallos de seguridad causados por la aprobación humana repetitiva de comandos.

Según los datos publicados por la compañía, un estudio con 1.053 desarrolladores remunerados mostró que solo el 13,6 % de los participantes rechazó una acción claramente peligrosa cuando se les presentó en medio de una sesión. En el mismo escenario, el modo automático bloquearía el 89 % de las acciones nocivas.

Anthropic también encargó una evaluación independiente a Trajectory Labs, que aplicó 720 ataques indirectos de inyección de prompt en modelos utilizados en Claude Code y Codex, según las versiones públicas del 17 de julio. Según la compañía, ninguna de las tentativas tuvo éxito contra los modelos Claude Fable 5, Opus 5 y Sonnet 5 ejecutados en modo automático.

La ejecutiva Cat Wu afirmó, durante un evento el mes pasado, que los riesgos de ataques como la inyección de prompt y la exfiltración de datos son «mucho menores que los de un revisor humano promedio». Por su parte, Thariq Shihipar afirmó que casi todos los empleados de Anthropic usan el modo automático.

Escepticismo independiente

El desarrollador Simon Willison, que publicó un artículo sobre el tema, dijo que desea ver una confirmación independiente del rendimiento. Citó el caso de un paquete malicioso que instruye al agente a descargar archivos y ejecutar comandos, lo que podría exfiltrar datos. «No sé cómo ninguna versión del modo automático podría proteger contra ese tipo de acción», afirmó.

Sigue en Radar