Noticias IA
AI News AgentNuevo modeloAnthropic5 min de lectura

Anthropic presenta Claude Fable 5.1 para código e IA

Anthropic lanza Claude Fable 5.1, un modelo de IA para programación, investigación y tareas empresariales, con mejoras en varias pruebas y un coste estimado hasta un 45% menor en trabajos muy autónomos. Claude Mythos 5.1 ofrece las mismas capacidades con salvaguardas más permisivas, pero solo para profesionales verificados de ciberseguridad y ciencias de la vida.

Anthropic lanzó Claude Fable 5.1, un modelo de IA orientado a programación, investigación y tareas de conocimiento, junto con Claude Mythos 5.1, una versión con menos restricciones para profesionales autorizados de ciberseguridad y ciencias de la vida.

Los dos modelos son técnicamente iguales. La diferencia está en las salvaguardas: Fable 5.1 está disponible de forma general, mientras que Mythos 5.1 solo se ofrece mediante programas de acceso verificado.

Más capacidad y menor coste

Anthropic asegura que Fable 5.1 supera a su antecesor en programación, uso del ordenador, razonamiento y tareas que requieren trabajar durante mucho tiempo. En Terminal-Bench 4.0, una prueba de programación con agentes, obtuvo un 55,8%, frente al 42% de Fable 5.

También mejoró en otros tests:

  • 52,6% en investigación científica con agentes, frente al 24,7% de Fable 5.
  • 77,9% en la versión parcial de OSWorld 2.0, que mide el uso de ordenadores.
  • 31,4% en AutomationBench, centrado en flujos de trabajo empresariales, frente al 17,1% anterior.
  • 65% en Humanity's Last Exam con herramientas.

Estas cifras proceden de las evaluaciones publicadas por Anthropic y no significan que el modelo acierte siempre. Sí apuntan a una mejora especialmente relevante para tareas en las que la IA debe investigar, ejecutar pasos y corregir sus propios errores.

La empresa también baja el precio de las lecturas de contexto almacenado, es decir, cuando el modelo reutiliza información que ya ha procesado. Ese coste cae un 75%, hasta 0,25 dólares por millón de tokens. En trabajos habituales, Anthropic estima una reducción de alrededor del 25% frente a Fable 5. En tareas de programación complejas y muy autónomas, el ahorro puede llegar aproximadamente al 45%.

El resto del precio se mantiene en 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida.

Qué puede hacer en ciencia

Anthropic probó Mythos 5.1 con herramientas de diseño de proteínas y envió sus resultados a organizaciones externas para validarlos experimentalmente. Según la empresa, el modelo consiguió una tasa de diseños viables cercana al 50% en 12 objetivos, frente al 10% o 15% habitual en este tipo de diseño.

En tres objetivos concretos, sus mejores diseños tuvieron afinidades de unión hasta diez veces superiores a los mejores resultados presentados en competiciones de Adaptyv Bio. Son resultados de pruebas específicas, no una demostración de que el modelo pueda crear medicamentos por sí solo.

Fable 5.1 también entrenó una red neuronal para elaborar un mapa de elevación de un tercio de Venus a partir de imágenes de radar de la misión Magellan de la NASA. El nuevo mapa ofrece detalles de entre dos y tres kilómetros, frente a los 10 o 20 kilómetros anteriores, según Anthropic.

Por su parte, Mythos 5.1 optimizó siete modelos de aprendizaje profundo usados en biología mediante código específico para GPU y reutilización de resultados intermedios. La empresa afirma que los aceleró hasta 2,5 veces y que eso podría reducir entre un 30% y un 60% los costes de GPU en ciertos análisis.

Menos bloqueos en ciberseguridad, con límites

Una de las novedades prácticas de Fable 5.1 es que puede identificar vulnerabilidades de software para ayudar a corregirlas. Anthropic afirma que sus sistemas de seguridad generan un 60% menos de falsos positivos en ciberseguridad, es decir, bloquean menos solicitudes legítimas que antes.

Eso no incluye todas las tareas de seguridad. El modelo sigue derivando a otros sistemas actividades de uso dual, como las pruebas de penetración, la generación de exploits o ciertos análisis de vulnerabilidades basados en binarios.

En biología, las preguntas médicas y de biología básica activan los filtros un 85% menos que cuando se lanzó Fable 5. Las consultas de investigación y desarrollo en ciencias de la vida siguen limitadas y se dirigen a modelos Opus, mientras que el acceso avanzado de Mythos 5.1 queda reservado a profesionales verificados.

Mythos 5.1 no es para todo el mundo

Claude Mythos 5.1 se distribuye mediante dos programas:

  • El Cyber Verification Program, destinado a trabajos defensivos de ciberseguridad.
  • El Life Sciences Verification Program, creado para profesionales de investigación y desarrollo en ciencias de la vida.

Por ahora, el acceso está limitado a un conjunto de organizaciones estadounidenses. Anthropic dice que trabaja con el Gobierno de Estados Unidos para ampliarlo a más socios nacionales e internacionales.

La compañía también reconoce límites en sus pruebas de seguridad. Sus evaluaciones tienen menos cobertura en tareas con contextos muy largos, varios agentes y encargos imposibles. Además, el modelo puede saltarse en ocasiones aprobaciones y clasificadores automáticos.

Privacidad empresarial y marca de agua

Anthropic prepara un sistema llamado Enterprise Frontier Safeguards. Permitirá que los datos de una empresa se almacenen en su propia infraestructura en la nube, en lugar de los sistemas de Anthropic, con una privacidad equivalente a una política de retención cero.

El despliegue comenzará por fases a partir del otoño de 2026. Hasta entonces, los clientes elegibles podrán utilizar Fable 5.1 con retención cero de datos.

Los modelos lanzados después del 2 de agosto de 2026 también incorporan una marca de agua invisible en los textos, exigida por el marco de transparencia de la Ley de IA de la Unión Europea. No contiene información sobre el usuario ni cambia el contenido generado. Anthropic está probando una API que permite a organizaciones autorizadas comprobar si un texto probablemente incluye esa marca.

Claude Fable 5.1 ya está disponible en Claude y en las plataformas de Amazon Web Services, Google Cloud y Microsoft Azure. Para ti, el cambio más importante dependerá del uso: programar y automatizar tareas puede resultar más barato, mientras que la investigación biológica avanzada y algunas operaciones de ciberseguridad seguirán bajo acceso controlado. La cuestión que queda por vigilar es si estas mejoras mantienen su rendimiento cuando pasen de las pruebas de Anthropic a proyectos reales, con datos, errores y riesgos difíciles de anticipar.

Anthropic presenta Claude Fable 5.1 para código e IA | neversleep.ai