IA y modelos
Anthropic lanza el modo automático para Claude Code
Anthropic lanzó una vista previa de investigación del "modo automático" para Claude Code, que permite a la IA ejecutar tareas de forma autónoma mientras utiliza salvaguardas para bloquear acciones riesgosas.
Anthropic ha introducido el “modo automático” para su herramienta Claude Code, una función diseñada para reducir la necesidad de que los desarrolladores supervisen manualmente cada acción realizada por la IA. Actualmente en vista previa de investigación —lo que significa que la función está disponible para pruebas pero aún no es un producto terminado—, la actualización busca eliminar la necesidad de que los desarrolladores supervisen cada acción. Según Anthropic, la herramienta está diseñada para permitir que la IA decida por sí misma qué acciones son seguras, equilibrando la velocidad con el control. Esto refleja un cambio más amplio en la industria, ya que las herramientas de IA están siendo diseñadas cada vez más para actuar sin esperar la aprobación humana.
Para gestionar esta autonomía, la función utiliza salvaguardas de IA integradas para revisar cada acción antes de que se ejecute. Estas salvaguardas verifican si hay “comportamiento riesgoso” que el usuario no solicitó, así como señales de “inyección de prompts”. La inyección de prompts es un tipo de ataque en el que se ocultan “instrucciones maliciosas” en el contenido que la IA está procesando, lo que puede causar que el sistema realice acciones no deseadas. Al filtrar estas acciones, las salvaguardas buscan prevenir resultados “riesgosos e impredecibles”. Las acciones seguras pueden proceder automáticamente, mientras que aquellas marcadas como riesgosas son bloqueadas.
Según Anthropic, la función de modo automático actualmente solo funciona con sus modelos Claude Sonnet 4.6 y Opus 4.6. Debido a los riesgos potenciales de dejar que el modelo funcione sin supervisión, la empresa recomienda que los desarrolladores utilicen la nueva función en “entornos aislados”. Estos son entornos separados de los sistemas de producción para limitar el daño potencial si algo sale mal.
El lanzamiento del modo automático sigue movimientos similares de pares de la industria como GitHub y OpenAI, que también han estado desarrollando herramientas de codificación autónomas que pueden ejecutar tareas en nombre de un desarrollador. Anthropic planea implementar la función para usuarios Enterprise y de API en los próximos días.
Por qué importa
El nuevo “modo automático” de Anthropic busca eliminar la necesidad de que los desarrolladores supervisen cada acción de la IA al permitir que el modelo decida qué acciones son seguras, equilibrando la velocidad con el control.