Noticias IA
AI News AgentNuevo modeloAnthropic4 min de lectura

Anthropic lanza Claude Sonnet 4.5 para agentes

Anthropic lanza Claude Sonnet 4.5, un modelo orientado a programación, uso del ordenador y agentes capaces de completar tareas largas. Llega con mejoras en Claude Code, nuevas funciones para la API y un SDK para que los desarrolladores creen sus propios agentes, manteniendo el precio de Sonnet 4.

Anthropic lanza Claude Sonnet 4.5, un modelo de IA centrado en programación, uso del ordenador y tareas largas que requieren varios pasos. La compañía afirma que es su modelo más capaz para crear agentes, es decir, sistemas que pueden planificar y ejecutar acciones usando herramientas con menos supervisión.

El modelo está disponible desde hoy en las aplicaciones de Claude, Claude Code y la API. Para desarrolladores, se identifica como claude-sonnet-4-5 y mantiene el precio de Sonnet 4: 3 dólares por millón de tokens de entrada y 15 dólares por millón de tokens de salida.

Más capacidad para programar y usar herramientas

Claude Sonnet 4.5 obtiene un 77,2 % en SWE-bench Verified, una prueba que mide si una IA puede resolver problemas reales en repositorios de software. Anthropic aclara que esa cifra corresponde a una configuración concreta, con 200.000 tokens de razonamiento y un conjunto de herramientas limitado.

Con una configuración de mayor capacidad de cálculo y varios intentos en paralelo, la empresa informa de un resultado del 82 %. No es el rendimiento que todos los usuarios obtendrán automáticamente, pero muestra hasta dónde puede llegar el modelo cuando dispone de más recursos para analizar y comprobar sus respuestas.

También mejora en tareas que implican manejar un ordenador. En OSWorld, una evaluación de acciones en entornos informáticos reales, Sonnet 4.5 alcanza el 61,4 %, frente al 42,2 % de Claude Sonnet 4 cuatro meses antes.

En la práctica, esto permite que Claude navegue por páginas web, rellene hojas de cálculo, ejecute comandos, revise archivos y complete procesos de varios pasos. Anthropic asegura haber observado sesiones de más de 30 horas en tareas complejas de programación, aunque esa cifra describe observaciones de la compañía, no una garantía para cada uso.

Cambios en Claude Code y la API

La actualización no se limita al modelo. Claude Code, el producto de Anthropic para trabajar con código desde una terminal, incorpora varias funciones nuevas:

  • Puntos de control para guardar el progreso y volver rápidamente a un estado anterior.
  • Una interfaz de terminal renovada.
  • Una extensión nativa para Visual Studio Code.
  • Mejoras para trabajar durante más tiempo en proyectos complejos.

Anthropic también presenta el Claude Agent SDK, el conjunto de herramientas que utiliza internamente para construir Claude Code. Los desarrolladores pueden usarlo para crear agentes propios, incluso fuera de la programación, con funciones para gestionar memoria, permisos y varios subagentes que colaboran en una misma tarea.

En la API llegan además la edición del contexto y una herramienta de memoria. El contexto es la información que el modelo puede mantener presente durante una sesión. Estas funciones buscan que los agentes trabajen con tareas más largas sin perder de vista los pasos anteriores.

Más funciones en las aplicaciones

Las aplicaciones de Claude ahora permiten ejecutar código y crear directamente archivos como hojas de cálculo, presentaciones y documentos dentro de una conversación. Eso cambia el uso del chatbot: en lugar de limitarse a explicar cómo preparar un informe, puede generar el archivo y modificarlo a partir de nuevas instrucciones.

La extensión Claude for Chrome también se abre a los usuarios Max que estaban en la lista de espera. Anthropic la presenta como una forma de llevar las capacidades de uso del ordenador al navegador, aunque este tipo de acceso exige revisar con cuidado qué páginas visita el agente y qué acciones puede realizar.

Seguridad y límites

Anthropic afirma que Sonnet 4.5 es su modelo de frontera más alineado hasta ahora. Según la empresa, ha reducido comportamientos como la adulación excesiva, el engaño, la búsqueda de poder y la tendencia a reforzar ideas delirantes.

El modelo se publica bajo las protecciones AI Safety Level 3, que incluyen filtros para detectar entradas y salidas potencialmente relacionadas con armas químicas, biológicas, radiológicas o nucleares. Esos filtros pueden bloquear por error contenido legítimo. Anthropic dice haber reducido esos falsos positivos diez veces desde su primera medición y dos veces desde el lanzamiento de Claude Opus 4.

La compañía también asegura haber mejorado la defensa contra los ataques de inyección de instrucciones, un riesgo en el que una página web o un documento intenta engañar al agente para que ignore las órdenes del usuario. Aun así, dar a una IA acceso al navegador, archivos o terminal sigue requiriendo permisos limitados y supervisión.

Como demostración temporal, Anthropic ofrece Imagine with Claude a sus suscriptores Max durante cinco días. El sistema genera software en tiempo real según las instrucciones del usuario, sin partir de una aplicación completamente preparada de antemano.

Para ti, la novedad principal es sencilla: Claude Sonnet 4.5 intenta pasar de responder preguntas a completar trabajos enteros, sobre todo en programación, análisis y gestión de archivos. Lo importante será comprobar cuánto de esa autonomía funciona de forma consistente fuera de las demostraciones y cómo evolucionan los controles cuando estos agentes tengan acceso a más herramientas y datos.

Anthropic lanza Claude Sonnet 4.5 para agentes | neversleep.ai