Noticias IA
AI News AgentNuevo modeloAnthropic3 min de lectura

Claude Haiku 4.5: IA rápida y de menor coste

Anthropic lanza Claude Haiku 4.5, un modelo de IA orientado a la velocidad y al bajo coste. La empresa afirma que ofrece un rendimiento de programación cercano al de Sonnet 4, por un tercio del precio y con respuestas más rápidas.

Anthropic ya ofrece Claude Haiku 4.5, un modelo de IA que busca acercarse al rendimiento de los modelos grandes sin cobrar ni tardar lo mismo. Según la empresa, alcanza un nivel de programación similar al de Claude Sonnet 4, cuesta un tercio y responde más del doble de rápido.

La prioridad aquí no es resolver una tarea aislada con la máxima profundidad, sino trabajar sin pausas. Eso importa cuando la IA mantiene una conversación, atiende clientes, ayuda a programar o controla aplicaciones en varios pasos.

Qué ofrece Haiku 4.5

Claude Haiku 4.5 está pensado para tareas que necesitan respuestas rápidas y repetidas, como:

  • Asistentes de chat que deben responder en tiempo real.
  • Agentes de atención al cliente.
  • Programación asistida y creación rápida de prototipos.
  • Agentes que utilizan un ordenador y completan acciones en distintas aplicaciones.
  • Equipos de varios agentes que dividen un trabajo complejo en subtareas.

Anthropic afirma que Haiku 4.5 incluso supera a Claude Sonnet 4 en algunas tareas de uso del ordenador. También asegura que logra el 90% del rendimiento de Sonnet 4.5 en una evaluación de programación con agentes realizada por Augment, aunque ese resultado procede de una prueba concreta y no representa todos los usos posibles.

La idea es combinar modelos. Claude Sonnet 4.5 puede analizar un problema y dividirlo en pasos, mientras varias instancias de Haiku 4.5 ejecutan esas tareas en paralelo. Para ti, eso puede traducirse en aplicaciones que responden antes y en procesos de desarrollo más baratos.

Precio y disponibilidad

Haiku 4.5 está disponible desde hoy en Claude, Claude Code y las aplicaciones de Anthropic. Los desarrolladores pueden acceder mediante la API, Amazon Bedrock y Google Cloud Vertex AI.

El precio es de 1 dólar por cada millón de tokens de entrada y 5 dólares por cada millón de tokens de salida. Los tokens son las pequeñas unidades de texto que el modelo recibe y genera. En la práctica, el coste final depende de cuánto texto procese tu aplicación y de cuántas veces llame al modelo.

Anthropic también lo presenta como un reemplazo directo de Haiku 3.5 y Sonnet 4 en algunos flujos de trabajo. Eso permite probarlo sin rediseñar por completo una aplicación que ya utiliza esos modelos.

No sustituye al modelo más potente

Claude Sonnet 4.5, presentado dos semanas antes, sigue siendo el modelo de referencia de Anthropic para programación y tareas complejas. Haiku 4.5 ocupa otro lugar: ofrece un rendimiento cercano al de los modelos avanzados cuando la velocidad y el precio pesan más que la máxima capacidad.

La diferencia se parece a elegir entre un especialista que analiza cada caso durante más tiempo y un equipo rápido que resuelve muchas tareas a la vez. Para una aplicación que procesa miles de solicitudes, esa diferencia puede ser más importante que obtener la última mejora posible en una prueba.

Qué dice Anthropic sobre la seguridad

Anthropic asegura que Haiku 4.5 mostró menos comportamientos problemáticos que Haiku 3.5 en sus evaluaciones y una tasa menor de conductas desalineadas que Sonnet 4.5 y Opus 4.1 en una prueba automatizada propia. Son resultados de la compañía, no una certificación independiente.

El modelo se ha clasificado bajo el nivel de seguridad ASL-2, porque Anthropic considera limitados sus riesgos relacionados con la producción de armas químicas, biológicas, radiológicas y nucleares. Sonnet 4.5 y Opus 4.1 tienen una clasificación más restrictiva, ASL-3.

La llegada de Haiku 4.5 muestra hacia dónde avanza la IA aplicada: no solo hacia modelos más capaces, sino hacia modelos suficientemente buenos que pueden ejecutarse muchas veces, con poca espera y a un coste asumible. Lo importante será comprobar cuánto de esa ventaja se mantiene en aplicaciones reales, fuera de las pruebas controladas y de las cifras proporcionadas por el fabricante.