NoticiasMacroAnthropic convierte el modo automático en la configuración predeterminada de Claude Code a partir del 14 de agosto

Anthropic convierte el modo automático en la configuración predeterminada de Claude Code a partir del 14 de agosto

Autor: CryptoBriefing·

Puntos clave

  • Anthropic establecerá el modo automático como la configuración de permisos predeterminada en Claude Code a partir del 14 de agosto de 2026.
  • Los usuarios aprobaban aproximadamente el 93% de las solicitudes bajo el sistema manual anterior, lo cual Anthropic consideró ineficaz como mecanismo de seguridad.
  • El modo automático emplea un clasificador de dos etapas que permite que las acciones de bajo riesgo se ejecuten automáticamente mientras marca las operaciones de mayor riesgo para aprobación manual.
  • La función es compatible con implementaciones a través de la API de Anthropic, AWS Bedrock y Google Vertex, abarcando los modelos Sonnet 4.6 y Opus 4.6+.
  • Los administradores pueden anular la nueva configuración predeterminada del modo automático y aplicar reglas personalizadas de permiso o bloqueo a nivel organizacional.
Anthropic convierte el modo automático en la configuración predeterminada de Claude Code a partir del 14 de agosto

Anthropic establecerá el modo automático como la configuración de permisos predeterminada en Claude Code a partir del 14 de agosto, reemplazando un sistema de aprobación manual que, según los datos de la empresa, los usuarios rara vez rechazaban.

Bajo la configuración anterior, los usuarios aprobaban aproximadamente el 93% de todas las solicitudes. Anthropic concluyó que esta tasa hacía que el paso de aprobación manual fuera en gran medida ineficaz como mecanismo de seguridad. El hallazgo coincide con un fenómeno bien documentado en el diseño de seguridad e interfaces conocido como fatiga de alerta o de aprobación, en el que los patrones habituales de aprobación erosionan el valor de los mensajes de permiso, independientemente de la acción específica que se solicite.

Cómo funciona el modo automático

El modo automático está diseñado como un punto intermedio entre dos extremos: por un lado, requerir la aprobación humana explícita para cada acción; por otro, otorgar al agente de IA plena autonomía sin restricciones.

El sistema evalúa el riesgo antes de ejecutar cualquier acción mediante un modelo clasificador que opera en dos etapas. Un filtro rápido de un solo token analiza primero las solicitudes entrantes. Si ese filtro inicial marca una solicitud como potencialmente riesgosa, se activa un mecanismo de cadena de pensamiento más exhaustivo para evaluar la acción con mayor detalle. Solo los mensajes del usuario y los comandos de herramientas pasan por el clasificador, lo que mantiene la sobrecarga de procesamiento al mínimo.

Las acciones de bajo riesgo —como leer un archivo o ejecutar un comando de compilación estándar— se ejecutan sin interrupciones. Las operaciones de mayor riesgo siguen activando un mensaje de aprobación manual. Anthropic también ha introducido reglas de permiso y bloqueo que permiten a los usuarios personalizar qué acciones se automatizan y cuáles requieren aprobación. Las organizaciones pueden aplicar sus propias políticas a nivel de administración.

De vista previa de investigación a configuración predeterminada en producción

Anthropic presentó por primera vez el modo automático como una vista previa de investigación los días 24 y 25 de marzo de 2026, dando a los desarrolladores varios meses para probar la función e identificar casos extremos antes de que se convirtiera en la experiencia estándar.

La función es compatible con múltiples entornos de implementación, incluida la API de Anthropic directamente, AWS Bedrock y Google Vertex. La compatibilidad de modelos abarca Sonnet 4.6 y Opus 4.6+, abarcando los modelos de Claude que los desarrolladores tienen más probabilidades de utilizar en sus flujos de trabajo de programación.

Los administradores que prefieran el sistema de aprobación manual anterior conservan la capacidad de anular la nueva configuración predeterminada.

Abordar la fatiga de aprobación

La tasa de aprobación del 93% bajo el sistema anterior pone de relieve un problema más amplio sobre cómo interactúan los usuarios con los mensajes de permiso. Cuando se aprueba casi todas las solicitudes, el proceso de aprobación deja de funcionar como una verificación de seguridad significativa y se convierte en un obstáculo procesal.

El modo automático tiene como objetivo resolver esto mostrando solicitudes de aprobación únicamente cuando el clasificador identifica un riesgo real, lo que hace que esas interrupciones sean más deliberadas cuando ocurren.

Este cambio se produce en un momento en que las herramientas de programación con IA en toda la industria —incluidas GitHub Copilot, Cursor y otras— continúan ampliando el alcance de las acciones que sus agentes pueden realizar dentro de los entornos de desarrollo, lo que convierte a la arquitectura de permisos en un diferenciador clave en cuánta confianza depositan los equipos en los flujos de trabajo de programación autónoma.

Para los desarrolladores que trabajan en un IDE con Claude Code activo durante sesiones prolongadas, el cambio es notable. Menos interrupciones permiten períodos más largos de trabajo concentrado. El agente de IA también puede encadenar operaciones de múltiples pasos sin detenerse a solicitar permiso en cada etapa, lo cual es particularmente útil para tareas como la refactorización en múltiples archivos o la ejecución de conjuntos de pruebas.