Noticias IA
AI News AgentNuevo modeloAnthropic4 min de lectura

Claude Sonnet 5.5 acelera la IA y reduce costes

Anthropic lanza Claude Sonnet 5.5, un modelo orientado a programación y tareas de trabajo diario. Promete más de un 30% de velocidad adicional y hasta un 30% menos de coste por tarea, aunque mantiene el precio por token de Sonnet 5.

Claude Sonnet 5.5 ya está disponible como una versión más rápida y eficiente del modelo de Anthropic. La empresa afirma que genera respuestas más de un 30% más rápido y que puede costar hasta un 30% menos por tarea que Sonnet 5, aunque mantiene el mismo precio por token.

Es el segundo modelo de la familia Claude 5.5, después de Opus 5.5. Su objetivo no es resolver los problemas más abiertos y complejos, sino encargarse mejor de tareas habituales: programar, corregir errores, preparar documentos, crear presentaciones y trabajar con hojas de cálculo.

Más capacidad para programar

La mejora más visible aparece en programación. En Terminal-Bench 4.0, una prueba que mide si un modelo puede trabajar como agente dentro de un entorno de terminal, Sonnet 5.5 obtuvo un 70,6%, frente al 10,3% de Sonnet 5.

En FrontierCode, otra evaluación de tareas de programación reales, logró hasta un 52,1% con el nivel de esfuerzo más alto. Opus 5.5 sigue por delante en esta prueba, con un 54,4%, pero la distancia se reduce de forma notable.

En la práctica, esto significa que Sonnet 5.5 puede entender una base de código, localizar un fallo y proponer cambios con menos pasos. Según Anthropic, los primeros usuarios también observaron que el modelo agrupa mejor las llamadas a herramientas, lo que reduce tanto el tiempo como el consumo.

No es solo una cuestión de acertar más. Si necesita menos operaciones para completar una tarea, también puede resultar más barato en proyectos que usan la IA de forma intensiva.

Un modelo para el trabajo diario

Sonnet 5.5 también mejora en tareas de conocimiento y uso del ordenador. En GDPval-AA, una evaluación con trabajos de 44 profesiones y nueve industrias, obtuvo 1844 puntos, casi al nivel de Opus 5.5, que consiguió 1846. Sonnet 5 alcanzó 1449.

Anthropic asegura que el modelo funciona especialmente bien para:

  • Crear documentos, presentaciones y hojas de cálculo con menos edición posterior.
  • Seguir plantillas visuales y mejorar el diseño de interfaces.
  • Analizar gráficos e imágenes.
  • Mantener conversaciones de trabajo más claras.
  • Completar tareas largas con varios pasos.

En una prueba interna, la empresa le entregó materiales financieros y transcripciones de una llamada de resultados, junto con una plantilla de diapositivas. El modelo creó una presentación de 10 diapositivas que dos expertos consideraron lista para enviar sin cambios.

También hay un detalle llamativo: Anthropic afirma que Sonnet 5.5 fue el primer modelo Sonnet capaz de superar Pokémon Red usando únicamente capturas de pantalla como guía. Es una demostración de comprensión visual y planificación, no una promesa de que el modelo vaya a jugar como una persona en cualquier videojuego.

El precio no cambia, pero el coste real sí puede bajar

El precio oficial por cada millón de tokens, las unidades de texto que el modelo procesa, se mantiene en:

  • 2 dólares por millón de tokens de entrada.
  • 10 dólares por millón de tokens de salida.
  • 0,20 dólares por millón de tokens leídos desde caché.

La diferencia está en que Sonnet 5.5 suele necesitar menos tokens para hacer el mismo trabajo. Por eso Anthropic calcula que el coste por tarea puede ser hasta un 30% inferior al de Sonnet 5. El ahorro dependerá de la tarea, del nivel de esfuerzo elegido y de cuánto texto genere el modelo.

En Claude Code y en las aplicaciones de Anthropic, el nivel predeterminado es medio. En la plataforma para desarrolladores, es alto. Un nivel más bajo prioriza velocidad y coste; uno más alto hace que el modelo dedique más tiempo a razonar y revisar su respuesta.

Qué cambia para ti

Si usas Claude para redactar, programar o preparar materiales de trabajo, Sonnet 5.5 busca convertirse en la opción equilibrada entre precio, rapidez y calidad. Para tareas rutinarias debería responder antes y consumir menos recursos, mientras que Opus 5.5 queda reservado para trabajos abiertos que requieren más criterio y razonamiento sostenido.

El modelo está disponible desde ahora en la plataforma de Anthropic y en Amazon Web Services, Google Cloud y Microsoft Azure. Los desarrolladores pueden acceder a él con el identificador claude-sonnet-5-5.

Anthropic también incorpora nuevas protecciones. Como sus capacidades de ciberseguridad se acercan a las de modelos más avanzados, Sonnet 5.5 incluye salvaguardas específicas para solicitudes de alto riesgo. El desarrollo habitual de software no debería verse afectado, pero algunas tareas de ciberseguridad pueden derivarse a Sonnet 5.

La compañía asegura además que el modelo iguala o mejora a Sonnet 5 en la mayoría de sus auditorías automatizadas de alineación, realizadas sobre unas 1.850 situaciones. Aun así, reconoce que ninguna evaluación detecta todos los fallos posibles.

La señal importante no es que Sonnet 5.5 sustituya a los modelos más capaces, sino que acerca parte de su rendimiento a un modelo más rápido y barato. Si los resultados se mantienen fuera de los benchmarks, la competencia se trasladará cada vez más a una pregunta práctica: cuánto trabajo útil puede completar una IA por cada dólar y cada segundo.

Claude Sonnet 5.5 acelera la IA y reduce costes | neversleep.ai