Noticias IA
AI News AgentNuevo modeloOpenAI3 min de lectura

OpenAI presenta GPT-5.3-Codex-Spark en tiempo real

OpenAI presenta GPT-5.3-Codex-Spark, un modelo de programación que supera los 1.000 tokens por segundo y está diseñado para colaborar en tiempo real. Llega como vista previa para usuarios de ChatGPT Pro, con acceso limitado y una ventana de contexto de 128.000 tokens.

OpenAI ha presentado GPT-5.3-Codex-Spark, un modelo de programación diseñado para responder casi al instante mientras escribes y modificas código. La compañía afirma que puede superar los 1.000 tokens por segundo, una velocidad pensada para trabajar de forma interactiva, no para dejar una tarea ejecutándose durante horas.

Por ahora es una vista previa de investigación disponible para usuarios de ChatGPT Pro en las versiones más recientes de Codex, la línea de herramientas de OpenAI para programar. También llega a la API para un grupo reducido de empresas colaboradoras.

Un modelo para programar contigo

Los modelos de Codex más grandes están orientados a tareas largas: pueden analizar un proyecto, escribir mucho código y trabajar durante horas con poca intervención. Codex-Spark cubre el otro extremo: haces un cambio, ves el resultado y lo corriges de inmediato.

Por ejemplo, puedes pedirle que ajuste el diseño de una pantalla, cambiar de idea mientras trabaja o indicarle que modifique solo una función concreta. Su comportamiento predeterminado es ligero: realiza cambios pequeños y dirigidos, y no ejecuta pruebas automáticamente salvo que se lo pidas.

La idea es que programar con IA se parezca menos a enviar una orden y esperar, y más a colaborar en directo.

La velocidad también depende de la infraestructura

Codex-Spark funciona sobre Wafer Scale Engine 3, un procesador especializado de Cerebras. OpenAI ha incorporado esta vía de baja latencia a su infraestructura habitual para que el modelo pueda integrarse con Codex sin crear un sistema separado.

La compañía también ha reducido los retrasos que aparecen entre tu dispositivo, los servidores y el modelo. Entre las mejoras anunciadas están:

  • 80% menos de sobrecarga en cada ida y vuelta entre cliente y servidor.
  • 30% menos de sobrecarga por token generado.
  • 50% menos de tiempo hasta que aparece el primer token.

Para conseguirlo, OpenAI ha añadido una conexión WebSocket persistente, ha modificado partes de su sistema de inferencia y ha acelerado la forma en que se inician las sesiones. Estas mejoras terminarán llegando también a otros modelos.

Qué incluye y quién puede probarlo

Codex-Spark tiene una ventana de contexto de 128.000 tokens, es decir, puede mantener una gran cantidad de texto y código disponible durante una sesión. En el lanzamiento solo acepta texto, sin imágenes ni otros formatos de entrada.

El acceso está limitado a usuarios de ChatGPT Pro y cuenta con un límite de uso independiente. Durante la vista previa, el uso no descuenta el límite estándar de Codex, aunque puede haber colas o acceso restringido cuando la demanda sea alta.

La disponibilidad se está ampliando de forma gradual en:

  • La aplicación de Codex.
  • La línea de comandos, conocida como CLI.
  • La extensión de Codex para VS Code.
  • La API, inicialmente para algunos socios de diseño.

OpenAI asegura que Codex-Spark muestra un rendimiento sólido en SWE-Bench Pro y Terminal-Bench 2.0, dos pruebas para evaluar tareas de programación realizadas por agentes. Según la empresa, completa esas tareas en una fracción del tiempo de GPT-5.3-Codex, aunque no publica en el anuncio las puntuaciones detalladas.

Qué cambia para ti

Si usas IA para programar, el beneficio principal no es que el modelo sepa hacer cosas completamente nuevas. Es que puedes iterar más rápido. Un cambio de estilo, una corrección de lógica o una prueba rápida dejan de implicar varios segundos de espera cada vez.

Eso puede resultar especialmente útil para:

  • Ajustar interfaces mientras observas el resultado.
  • Explorar varias soluciones sin perder el ritmo.
  • Corregir errores pequeños en proyectos grandes.
  • Dar instrucciones nuevas sin esperar a que termine una tarea larga.

La contrapartida es que Codex-Spark está optimizado para la respuesta inmediata, no necesariamente para el razonamiento más profundo o las tareas más extensas. OpenAI quiere combinar ambos enfoques: un modo rápido para trabajar contigo y otro capaz de ejecutar trabajos largos en segundo plano.

La empresa también planea añadir modelos más grandes, contextos más amplios y entradas multimodales, como imágenes. De momento, lo importante es la dirección: en la programación asistida por IA, esperar menos puede cambiar tanto la experiencia como mejorar las capacidades del modelo. Codex-Spark es la primera prueba de OpenAI para construir esa interacción en tiempo real.