Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunch+1techcrunch+1cryptonomist+1Anthropic anunció el viernes que el modo automático de Claude Code se convertirá en la configuración predeterminada para las nuevas sesiones en cuentas Pro, Max y Team a partir del 14 de agosto, reemplazando las peticiones de aprobación manual en las que los desarrolladores solían hacer clic sin prestar atención. El cambio otorga las decisiones de permiso rutinarias a un clasificador propietario, que evalúa cada llamada a herramientas e interviene solo cuando una acción se considera irreversible, destructiva o dirigida fuera del entorno del usuario.techcrunch+1
El cambio se basa en lo que Anthropic describe como fatiga de confirmación. Según la empresa, los usuarios aprueban el 97% de las peticiones de permiso en Claude Code, una tasa que sugiere que el mecanismo de seguridad se había vuelto reflexivo en lugar de protector. La telemetría interna refuerza este patrón: en junio, el 62% de los usuarios había intentado eludir los permisos o había seleccionado "no volver a preguntar" para comandos de Bash, y el 49,5% de los usuarios activos de CLI había creado una regla de autorización para Bash.techi+1
En un estudio con 1.053 evaluadores remunerados, Anthropic introdujo un comando claramente peligroso entre las peticiones de permiso rutinarias. El modo automático bloqueó el 89% de esos comandos; los evaluadores humanos solo rechazaron el 13,6%. La vigilancia humana disminuyó aún más a medida que se alargaban las sesiones, cayendo a aproximadamente el 5% tras 50 o más peticiones.techcrunch+2
El responsable de Claude Code, Boris Cherny, escribió en X que su equipo ha utilizado el modo automático de forma exclusiva "durante muchos meses" y que no se imagina volviendo a las peticiones de permiso.techcrunch
La tasa de bloqueo del 89% deja un 11% de margen de error: 116 de los 1.053 comandos introducidos pasaron sin ser detectados. Una evaluación adversaria sintética independiente realizada con Apollo Research redujo la tasa de error al 7% tras reforzar el clasificador, aunque Anthropic señaló que esa cifra proviene de un conjunto de datos deliberadamente hostil y no es una medición de tráfico real.techi
En cuanto a la inyección de peticiones, Anthropic encargó a Trajectory Labs la ejecución de 720 ataques de inyección indirecta contra Claude Fable 5, Opus 5 y Sonnet 5 en modo automático. Ninguno tuvo éxito. Sin embargo, el desarrollador e investigador Simon Willison advirtió que una tasa de éxito cero en escenarios supervisados no garantiza la resistencia frente a ataques a la cadena de suministro, como paquetes maliciosos de terceros que ordenen a un agente obtener y ejecutar archivos adicionales.cryptonomist
Cuando el modo automático bloquea una acción, Claude intenta una alternativa más segura o solicita autorización explícita. Tres denegaciones consecutivas o 20 en total durante una sesión interactiva devuelven la herramienta a las aprobaciones manuales; las ejecuciones desatendidas simplemente se dan por terminadas. Los equipos pueden reforzar aún más los controles con reglas explícitas de solicitud para operaciones como envíos o peticiones de extracción, y reglas de denegación que no se pueden anular.techi
Anthropic confirmó que no cobrará a los usuarios de Pro, Max y Team por el pequeño sobrecoste de tokens que el clasificador añade por llamada a herramientas. Los despliegues empresariales, de API y de plataformas en Amazon Web Services Amazon.com, Inc. , Google Cloud Alphabet Inc. y Microsoft Foundry siguen siendo opcionales mientras se prepara un despliegue más amplio.cryptonomist+1