Noticias IA
AI News AgentNuevo modeloOpenAI4 min de lectura

OpenAI lanza GPT-5.4 para trabajo y agentes

OpenAI lanza GPT-5.4 en ChatGPT, la API y Codex con mejoras en razonamiento, programación, documentos y uso autónomo del ordenador. El modelo admite hasta 1 millón de tokens de contexto y reduce el coste de trabajar con muchas herramientas, aunque las funciones más avanzadas dependen de la integración y la supervisión de cada aplicación.

OpenAI ha lanzado GPT-5.4 en ChatGPT, la API y Codex, con una apuesta clara: que la IA no solo responda, sino que complete tareas profesionales de principio a fin. El modelo combina razonamiento, programación, uso de herramientas y trabajo con documentos, hojas de cálculo y presentaciones.

También llega GPT-5.4 Pro, una versión orientada a tareas especialmente complejas. En ChatGPT, el modelo aparece como GPT-5.4 Thinking y puede mostrar un plan inicial antes de empezar a trabajar, para que ajustes el rumbo sin tener que esperar a que termine.

Una IA que trabaja dentro de tus aplicaciones

La principal novedad está en el uso del ordenador. GPT-5.4 puede interactuar con páginas web y programas mediante capturas de pantalla, teclado y ratón, o bibliotecas como Playwright. En la práctica, un agente podría navegar por un portal, extraer información, completar formularios y verificar el resultado.

OpenAI afirma que GPT-5.4 obtuvo un 75% de éxito en OSWorld-Verified, una prueba de tareas en entornos de escritorio, frente al 47,3% de GPT-5.2. La cifra también supera el 72,4% registrado para personas en esa evaluación concreta.

El modelo admite hasta 1 millón de tokens de contexto, es decir, puede mantener mucha más información disponible durante tareas largas. Esto resulta útil para revisar grandes cantidades de documentos, seguir un proyecto de varias horas o coordinar muchos pasos sin perder el hilo.

Eso no significa que cualquier usuario de ChatGPT vaya a tener automáticamente un agente autónomo capaz de manejar todo su ordenador. Estas funciones dependen de cómo las integren los desarrolladores y de las confirmaciones de seguridad que configuren.

Mejoras para el trabajo profesional

GPT-5.4 está especialmente enfocado en tareas que suelen consumir horas de trabajo:

  • Crear y editar hojas de cálculo, presentaciones y documentos.
  • Analizar contratos y preparar informes.
  • Escribir, probar y depurar código.
  • Investigar en la web preguntas que requieren consultar muchas fuentes.
  • Coordinar varios servicios mediante herramientas y conectores.

En una prueba interna de modelado financiero, OpenAI obtuvo una puntuación media del 87,3%, frente al 68,4% de GPT-5.2. En otra evaluación, los participantes prefirieron las presentaciones generadas por GPT-5.4 el 68% de las veces frente a las de la versión anterior.

En GDPval, una prueba sobre trabajo de conocimiento en 44 profesiones, GPT-5.4 igualó o superó el resultado de profesionales en el 83% de las comparaciones, frente al 70,9% de GPT-5.2. Son resultados publicados por OpenAI y proceden de evaluaciones controladas, por lo que no garantizan el mismo rendimiento en cada caso real.

Menos errores y mejor uso de herramientas

OpenAI asegura que GPT-5.4 es su modelo más preciso hasta ahora. En un conjunto de consultas cuyos errores habían sido señalados por usuarios, sus afirmaciones individuales fueron un 33% menos propensas a ser falsas que las de GPT-5.2, mientras que sus respuestas completas tuvieron un 18% menos de probabilidades de contener algún error.

La API incorpora además tool search. En lugar de cargar desde el principio la descripción de miles de herramientas, el modelo puede buscar la definición que necesita justo cuando va a utilizarla. En una prueba con 36 servidores MCP, esta función redujo el uso total de tokens un 47% sin cambiar la precisión.

Para ti, esto puede traducirse en agentes más rápidos y baratos cuando trabajan con muchos servicios conectados. También reduce la información innecesaria que el modelo tiene que procesar en cada petición.

Qué cambia en ChatGPT, Codex y la API

GPT-5.4 Thinking está disponible desde hoy para usuarios Plus, Team y Pro, y sustituye a GPT-5.2 Thinking como opción principal. GPT-5.2 Thinking seguirá en la sección de modelos antiguos durante tres meses, hasta el 5 de junio de 2026. Los planes Enterprise y Edu pueden activar el acceso anticipado desde la configuración de administración.

GPT-5.4 Pro queda reservado para los planes Pro y Enterprise en ChatGPT, además de estar disponible en la API. En la API, los modelos se identifican como gpt-5.4 y gpt-5.4-pro.

El precio de gpt-5.4 es de 2,50 dólares por millón de tokens de entrada y 15 dólares por millón de tokens de salida. Es más caro que GPT-5.2, aunque OpenAI afirma que necesita menos tokens para resolver muchas tareas. El modo rápido de Codex puede aumentar hasta 1,5 veces la velocidad de generación sin cambiar el modelo ni su capacidad.

La llegada de GPT-5.4 apunta a una transición importante: el valor de estos modelos ya no está solo en redactar una respuesta, sino en planificar, usar programas, comprobar resultados y completar flujos de trabajo largos. Lo que habrá que vigilar ahora es cuánto de esa promesa se mantiene fuera de las pruebas de OpenAI y con qué nivel de supervisión humana se despliegan estos agentes.