CourionAI
ES
Boletín
← Todas las noticias
anthropic 3 min de lectura

Claude Code activa el Auto Mode de forma predeterminada y los números de seguridad no son lo que imaginas

A partir del 14 de agosto, la herramienta de codificación de Anthropic dejará de pedir permiso para cada paso. En sus propias pruebas, un clasificador de software detectó el 89 por ciento de los comandos peligrosos. Los humanos a los que reemplaza capturaron el 13,6 por ciento.

Un transportador de hojas de papel en blanco que pasan a través de una puerta mecánica debajo de una gran lente vigilante, con una hoja levantada a un lado mientras el resto fluye

A partir del 14 de agosto, la herramienta de codificación de Anthropic, Claude Code, se ejecutará en Auto Mode de forma predeterminada para cualquier persona con un plan Pro, Max o Team. El Auto Mode significa que la IA deja de detenerse. En lugar de pedirle que apruebe cada comando que quiere ejecutar, sigue funcionando y una pieza separada de software vigila por encima del hombro e interrumpe sólo cuando algo parece peligroso o difícil de deshacer.

Ese observador es lo que la industria llama un clasificador: un modelo pequeño cuyo único trabajo es observar una acción propuesta y responder una pregunta, es así de arriesgado. Anthropic realizó un estudio controlado con 1.053 evaluadores pagos más un red teaming interno, donde el personal intenta deliberadamente hacer que el sistema se comporte mal. El clasificador marcó el 89 por ciento de las órdenes realmente peligrosas. Los revisores humanos, que hicieron clic en aprobar o rechazar los mismos comandos, captaron el 13,6 por ciento. Los equipos que se ejecutan en Auto Mode también produjeron aproximadamente un 25 por ciento más de solicitudes de extracción, lo que significa que terminaron más trabajo.

Hay un segundo número que vale la pena señalar. Una auditoría independiente realizada por Trajectory Labs probó 72 escenarios de inyección rápida diez veces cada uno. La inyección rápida se produce cuando el texto oculto en una página web o en un archivo intenta dar nuevas órdenes a la IA a sus espaldas, y ha sido el gran problema de seguridad sin resolver de los agentes de IA. Ninguno de los 720 intentos superó los modelos actuales de Claude en Auto Mode. Al ejecutar la misma batería contra el GPT-5.6 Sol de OpenAI en el modo de revisión automática del Codex, se perdió el 5,83 por ciento.

La cifra del 13,6 por ciento es interesante y no es un insulto para los desarrolladores. Es fatiga de aprobación. Cuando una herramienta te pide que confirmes cuarenta cosas por hora, dejas de leer y comienzas a hacer clic, que es exactamente como se envía un comando incorrecto. El clasificador nunca se aburre. Anthropic da dos ejemplos internos: el Auto Mode impidió que Claude cargara datos confidenciales en una página pública, y durante una larga sesión eliminó aproximadamente 2000 procesos que habrían arruinado los trabajos de entrenamiento de GPU en curso. Vale la pena mencionar también el ángulo comercial: cuando Claude trabaja más tiempo sin parar, consume más tokens y los tokens son ingresos. Anthropic no cobra por los tokens que el clasificador quema, lo que suaviza un poco la situación.

Qué significa esto para ti: si utilizas Claude Code, el cambio se activa automáticamente el 14 de agosto. Revisa la configuración antes de encontrártelo por sorpresa. Los clientes empresariales siguen en modo manual salvo que decidan activarlo. Anthropic todavía recomienda revisar a mano las acciones de Claude cuando afectan a sistemas de producción o implican mucho riesgo. Es una advertencia razonable: un 89 por ciento es mucho mejor que un 13,6 por ciento, pero no llega al 100. Aunque no programes, el patrón importa porque se está extendiendo. La respuesta de diseño a «la IA hace cosas arriesgadas» consiste cada vez más en que una segunda IA supervise a la primera. Conviene saber que esa es la protección que se está utilizando.

Fuentes

Fuentes: https://claude.com/blog/auto-mode-default-in-claude-code

Siguiente artículo

Las sesiones de Claude Code ahora pueden enviarse mensajes entre sí, lo cual es más extraño de lo que parece

Dos ventanas de terminal que ejecutan la misma herramienta de codificación de IA ahora pueden pasar notas de un lado a otro sin que usted copie nada. Es una pequeña característica que cambia silenciosamente lo que es una sesión de trabajo.

Dos terminales de computadora antiguos uno frente al otro, unidos por una cuerda tensa que lleva una nota de papel doblada entre ellos