IA y modelos
Anthropic lanza el Claude Sonnet 5, más económico y con mayores capacidades de agente
Anthropic ha lanzado Claude Sonnet 5, un modelo más potente y con capacidades de agente que promete un rendimiento cercano al de Opus 4.8 a un precio más bajo.
Anthropic ha lanzado Claude Sonnet 5, un nuevo modelo de tamaño mediano diseñado para ser más potente y con capacidades de agente que sus predecesores. En este contexto, el término «con capacidades de agente» se refiere a modelos de IA capaces de planificar, utilizar herramientas como navegadores y terminales, y actuar de forma autónoma. Según Anthropic, el modelo puede elaborar planes, utilizar herramientas y ejecutarse de forma autónoma a un nivel que anteriormente requería modelos más grandes y costosos. El martes, Claude Sonnet 5 se convirtió en el modelo predeterminado para los planes gratuitos y Pro.
El modelo se posiciona como una alternativa rentable a modelos más grandes, incluidos el propio Opus 4.8 de Anthropic, el GPT-5.5 de OpenAI y el Gemini 3.1 Pro de Google. Anthropic declaró que, si bien Opus 4.8 sigue siendo el modelo preferido para tareas que requieren mayor precisión, Sonnet 5 ofrece a los desarrolladores una opción de menor precio y mayor calidad que la disponible anteriormente. Los usuarios pueden ajustar el nivel de esfuerzo entre ambos modelos para encontrar el equilibrio adecuado entre costo y rendimiento.
La estructura de precios de Claude Sonnet 5 es la siguiente:
- Hasta el 31 de agosto: USD 2 por millón de tokens de entrada y USD 10 por millón de tokens de salida.
- Después del 31 de agosto: USD 3 por millón de tokens de entrada y USD 15 por millón de tokens de salida.
Anthropic reporta mejoras significativas en el rendimiento de las capacidades de agente de Sonnet 5 en comparación con Sonnet 4.6, lanzado en febrero. En una evaluación comparativa de codificación con capacidades de agente, Sonnet 5 obtuvo un 63.2%, frente al 58.1% de Sonnet 4.6 y el 69.2% de Opus 4.8. Los evaluadores han reportado que el modelo completa con éxito tareas complejas de varias partes que antes se estancaban. Daniel Shepard, ingeniero senior en Zapier, declaró: «Le asignamos a Claude Sonnet 5 una tarea de dos partes —actualizar los niveles de cuenta de Salesforce y enviar un anuncio de lanzamiento a los contactos empresariales— y la completó de principio a fin. Antes, eso se quedaba a medias. Para la automatización diaria, es una opción obvia».
En cuanto a la seguridad, Anthropic reporta que Sonnet 5 exhibe una menor tasa de comportamientos indeseables, como la cooperación con el uso indebido y el engaño, en comparación con versiones anteriores. El modelo es mejor para rechazar solicitudes maliciosas y evitar intentos de secuestro en ataques de inyección de prompts. También alucina y participa en comportamientos de adulación a una tasa menor que Sonnet 4.6. Sin embargo, sigue siendo menos capaz que Opus 4.8 para realizar tareas peligrosas de ciberseguridad y no está al mismo nivel en cuanto a comportamiento desalineado. Fabian Hedin, cofundador de Lovable, declaró que Claude Sonnet 5 rechaza las solicitudes inseguras de forma limpia y consistente, y añadió que un modelo capaz de rechazar solicitudes inseguras es tan importante como uno que sabe cómo construir.
Por qué importa
El lanzamiento de Claude Sonnet 5 confirma que la capacidad de agente es ahora la expectativa base para los modelos de IA en todos los niveles de precio. La competencia central del mercado ha pasado de determinar qué proveedor puede ofrecer trabajo con capacidades de agente a qué tan barato y confiable pueden ejecutarlo sin supervisión humana.