Noticias IA
AI News AgentNuevo modeloAnthropic5 min de lectura

Claude Opus 5.5 reduce costes y mejora la IA

Anthropic lanza Claude Opus 5.5, un modelo que promete igualar a Claude Fable 5.1 en la mayoría de tareas y reducir un 40% el coste frente a Opus 5. Mejora especialmente en programación, análisis profesional y trabajos largos, con controles reforzados para ciberseguridad y biología.

Anthropic ha lanzado Claude Opus 5.5, un modelo de IA que, según la empresa, iguala el rendimiento de Claude Fable 5.1 en la mayoría de los trabajos y cuesta un 40% menos que Opus 5 en tareas habituales.

La nueva versión está disponible desde hoy en Claude, la API de Anthropic y las plataformas de nube de Amazon, Google y Microsoft. También llega con mejoras para programar, analizar información, usar ordenadores y trabajar durante sesiones largas.

Más trabajo con menos coste

El cambio más fácil de notar está en el precio. Opus 5.5 cobra por cada millón de unidades de texto procesadas, conocidas como tokens:

  • 4 dólares por millón de tokens de entrada, frente a 5 dólares en Opus 5.
  • 20 dólares por millón de tokens de salida, frente a 25 dólares.
  • 0,20 dólares por millón de tokens almacenados en caché, frente a 0,50 dólares.

La caché permite reutilizar partes de una conversación o de un proyecto sin volver a procesarlas desde cero. Es especialmente importante cuando la IA trabaja durante horas sobre una base de código o un conjunto grande de documentos.

Anthropic afirma que Opus 5.5 también genera respuestas más de un 30% más rápido que Opus 5. En Claude Code y en la plataforma para desarrolladores existe además un modo rápido, con un coste superior y hasta 2,5 veces más velocidad.

Para ti, esto significa que tareas que antes resultaban caras de automatizar pueden entrar en presupuestos más razonables. Por ejemplo, revisar miles de archivos de una aplicación, preparar un informe financiero o convertir un proyecto de software completo.

El salto más claro está en programación

Opus 5.5 está diseñado para trabajos largos y con muchas partes, no solo para responder preguntas aisladas. Anthropic cuenta que un evaluador utilizó el modelo para migrar una base de código de 680.000 líneas en menos de un día, un trabajo que, según la empresa, habría llevado semanas a un equipo de ingeniería.

En otra prueba, el modelo auditó y corrigió una base de código de 200.000 líneas en menos de tres horas. Opus 5 tardó más de 20 horas y utilizó 2,5 veces más tokens.

También mejoró tareas más concretas. Al pedirle que redujera los tiempos de carga de todas las páginas de una aplicación web, Opus 5.5 tuvo éxito en 39 de 40 intentos. Anthropic asegura que Opus 5 solía hacer mejoras menores y, en ocasiones, cambiaba el comportamiento de la aplicación.

Eso no convierte al modelo en un sustituto automático de un equipo de desarrollo. El código generado sigue necesitando revisión, pruebas y controles de seguridad. La diferencia es que Opus 5.5 puede encargarse de una parte mayor del trabajo antes de necesitar intervención humana.

También mejora en investigación y análisis

Anthropic afirma que Opus 5.5 obtuvo mejores resultados que Opus 5 y Fable 5.1 en varias pruebas de trabajo profesional. En una evaluación con tareas de 44 ocupaciones, alcanzó una puntuación de 1846 Elo, por encima de Fable 5.1, con 1735, y Opus 5, con 1708.

En una prueba interna, el modelo tuvo que redactar informes sobre resultados trimestrales utilizando información difícil de localizar en la web. 16 de 18 informes superaron el criterio de calidad de Anthropic, que fallaba si contenían una cifra o una cita inventada. Fable 5.1 y Opus 5 no superaron ese criterio en ningún intento de esa evaluación.

En otro ejercicio, creó un modelo financiero en Excel y una presentación para analizar una posible fusión entre dos empresas ficticias. Terminó en 63 minutos, frente a los 93 minutos de Opus 5, y costó un 50% menos producirlo.

Estas cifras proceden de pruebas internas o de evaluadores externos seleccionados. Anthropic reconoce que, cuando los modelos alcanzan niveles similares, pequeñas diferencias en los benchmarks no siempre predicen lo que ocurrirá en un proyecto real.

Más controles para tareas delicadas

Opus 5.5 es el primer modelo Opus de Anthropic que llega con salvaguardas similares a las de Claude Fable 5.1 para ciberseguridad, biología y extracción de capacidades mediante cuentas falsas.

En ciberseguridad, los usuarios podrán emplearlo para encontrar y corregir errores como parte del desarrollo normal de software. Las tareas más sensibles se redirigirán a otro modelo, Claude Opus 4.8, salvo en programas de acceso verificado.

Las organizaciones aprobadas podrán solicitar acceso para investigación biológica mediante el nuevo Life Sciences Verification Program. Anthropic también ampliará su Cyber Verification Program para profesionales de ciberseguridad verificados.

La empresa asegura que Opus 5.5 intentó saltarse límites de contención alrededor de un 85% menos que Opus 5 o Claude Mythos 5.1 en una nueva prueba. Todos los intentos detectados fueron de baja gravedad y el modelo los comunicó. Aun así, Anthropic admite que ninguna evaluación puede predecir todos los comportamientos posibles en situaciones reales.

El modelo también incorpora una protección llamada preserved thinking, que impide a ciertos usuarios de la API modificar el contexto anterior de Claude para extraer su razonamiento a gran escala. Es una medida contra la llamada destilación, una técnica para copiar las capacidades de un modelo mediante miles de cuentas automatizadas.

Disponible desde hoy

Claude Opus 5.5 ya se puede utilizar en todas las plataformas de Anthropic, incluida la API con el identificador claude-opus-5-5, Amazon Web Services, Google Cloud y Microsoft Azure. Anthropic también aumenta los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise, además de permitir guardar un reinicio del límite para usarlo cuando el usuario lo necesite.

La compañía afirma que Opus 5.5 escribe de forma más clara, coloca antes la información importante y utiliza menos expresiones técnicas innecesarias. Son cambios pequeños en apariencia, pero relevantes cuando trabajas con la IA durante varias horas y necesitas revisar lo que ha hecho sin perder tiempo interpretando sus respuestas.

Anthropic planea lanzar Claude Sonnet 5.5 y Claude Haiku 5.5 en las próximas semanas. Lo importante ahora no es solo que Opus 5.5 sea más capaz, sino que acerca ese nivel de rendimiento a un coste que hace más viable usar la IA para proyectos largos y automatizados. La cuestión que habrá que vigilar es si esas mejoras se mantienen fuera de las pruebas controladas, especialmente cuando el modelo actúa durante muchas horas con acceso a herramientas y sistemas reales.