En resumen
Anthropic informó que el modo automático de Claude Code se activará de forma predeterminada en nuevas sesiones de las cuentas Pro, Max y Team a partir del 14 de agosto. La empresa afirma que la función detectó más acciones peligrosas que la revisión manual en una prueba con 1.053 usuarios de pago, pero recomienda supervisión para cambios de alto riesgo.
Anthropic anunció que el modo automático de Claude Code será el predeterminado para nuevas sesiones en los planes Pro, Max y Team a partir del 14 de agosto. La configuración permite que el agente ejecute etapas sin solicitar aprobación humana para cada acción, excepto cuando el sistema clasifica la operación como irreversible, destructiva o dirigida fuera del entorno del usuario.
El cambio representa una modificación del equilibrio entre autonomía y control. En lugar de depender principalmente del usuario para aprobar cada solicitud de permiso, Claude Code enviará las llamadas a herramientas a un clasificador de seguridad antes de ejecutarlas.
Qué cambia en el funcionamiento
En el modo automático, el agente puede trabajar durante períodos más largos sin interrumpir el flujo para solicitar autorización. Cuando el clasificador bloquea una acción, Claude puede intentar una alternativa más segura o solicitar aprobación. Si se producen tres bloqueos consecutivos o 20 bloqueos en una sesión, el sistema vuelve a las aprobaciones manuales, de acuerdo con la descripción divulgada por Anthropic.
La empresa afirma que también añadió mecanismos como la detección de inyecciones de instrucciones y reglas estrictas personalizables para bloquear comportamientos como la exfiltración de datos. Sin embargo, el material proporcionado no detalla la cobertura de cada protección ni presenta resultados independientes que permitan medir su desempeño en distintos entornos.
Los usuarios que ya hayan elegido otra configuración podrían recibir una solicitud única para decidir si desean adoptar el modo automático. El cambio inicial no se aplica de la misma manera a todas las ofertas de Anthropic: los clientes Enterprise y los usuarios de los servicios de nube y plataforma mencionados en las fuentes todavía pueden mantener la función como opcional.
La evidencia presentada por Anthropic
En un estudio controlado con 1.053 usuarios de pago, Anthropic afirma que el modo automático identificó el 89% de las acciones peligrosas, frente al 13,6% de la revisión humana. La empresa relaciona la diferencia con el comportamiento de aprobación repetitiva: según sus datos, los usuarios aprueban el 97% de las solicitudes de permiso de Claude Code.
Estas cifras son resultados presentados por la propia Anthropic, aunque las fuentes mencionan evaluaciones internas, pruebas externas y análisis de sesiones reales. El expediente no proporciona el diseño completo del experimento, la definición utilizada para «acción peligrosa», la distribución de los participantes ni los datos brutos. Por lo tanto, los porcentajes no deben considerarse una comparación universal entre agentes o equipos de desarrollo.
La empresa también sostiene que el modo automático fue más seguro o tan seguro como la revisión manual en las medidas evaluadas. Esta conclusión es una declaración corporativa basada en las pruebas descritas, no una validación independiente documentada en las fuentes proporcionadas.
Por qué el cambio importa para los equipos
La adopción predeterminada reduce las interrupciones para quienes usan Claude Code en tareas extensas, pero también traslada una decisión operativa importante a un sistema automatizado. En la práctica, la seguridad pasa a depender de la capacidad del clasificador para comprender el contexto, distinguir una acción legítima de una destructiva y reconocer instrucciones maliciosas insertadas en archivos o dependencias.
Este diseño puede ser útil en entornos de desarrollo aislados, donde los cambios pueden revertirse y los accesos son limitados. El riesgo es mayor cuando el agente accede a repositorios sensibles, credenciales, datos de clientes o sistemas de producción. La propia Anthropic recomienda revisar las acciones antes de realizar cambios de alto impacto, lo que limita la interpretación de que el modo automático sustituya la gobernanza humana.
- La activación predeterminada comienza el 14 de agosto para Pro, Max y Team.
- El modo sigue siendo opcional en Enterprise, la API y las plataformas de nube mencionadas por las fuentes.
- Los bloqueos sucesivos pueden hacer que la sesión vuelva a la aprobación manual.
- Anthropic recomienda supervisión humana para producción e infraestructura crítica.
Según la confirmación publicada por Help Net Security, la empresa planea ampliar el modo automático predeterminado a las demás plataformas el mes siguiente. La fuente también informa que Anthropic pretende dejar de cobrar por el procesamiento adicional del clasificador de seguridad, pero el expediente no presenta detalles sobre precios ni condiciones contractuales.
El principal punto que se debe seguir es si el cambio conservará suficientes controles administrativos para las organizaciones que necesitan registrar, auditar y limitar las acciones automatizadas. También será importante observar incidentes, bloqueos erróneos y resultados fuera del conjunto de pruebas utilizado por Anthropic. Hasta ahora, las fuentes proporcionadas confirman el cambio y las afirmaciones de la empresa, pero no permiten concluir cómo se comportará la función en todos los escenarios de desarrollo.
Nuestro prisma
El cambio convierte la autonomía en el camino predeterminado para parte de los usuarios de Claude Code, pero no transforma al agente en un sistema sin riesgos. El resultado presentado por Anthropic sugiere que las aprobaciones manuales repetitivas pueden fallar como control de seguridad, aunque los datos disponibles no son suficientes para generalizar la conclusión. En la práctica, los equipos deben combinar la función con entornos aislados, permisos mínimos y revisión para cambios críticos. La prueba decisiva será su desempeño en situaciones reales, especialmente ante inyecciones de instrucciones y el acceso a sistemas sensibles.
Fuentes: TechCrunch (IA) · Help Net Security
Preguntas frecuentes
¿Cuándo se activará el modo automático de forma predeterminada?
El cambio comienza el 14 de agosto para nuevas sesiones en los planes Pro, Max y Team.
¿La función será obligatoria en todas las plataformas?
No. Seguirá siendo opcional en Enterprise, la API, Anthropic Platform, Amazon Bedrock, Google Cloud’s Agent Platform y Microsoft Foundry, según la empresa.
¿El modo automático elimina la necesidad de revisión humana?
No. Anthropic recomienda revisar las acciones antes de realizar cambios en sistemas de producción o infraestructura crítica.
Recibe Radar de IA todos los días
Las noticias de inteligencia artificial que importan — con nuestro prisma y siempre con las fuentes. Gratis.






