OpenAI prueba GPT-5.6 Sol hasta 14 veces más rápido
OpenAI prueba Ultrafast, un nuevo nivel de la API que ejecuta GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento Standard. Con tecnología de Cerebras, puede generar hasta 750 tokens por segundo, aunque el acceso todavía está limitado a un grupo inicial de clientes.

OpenAI está probando Ultrafast, un nuevo nivel de servicio que permite usar GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento Standard. El acceso comienza en la API de OpenAI y, por ahora, se limita a un grupo inicial de clientes.
La velocidad llega gracias a la colaboración con Cerebras. En las condiciones anunciadas, el sistema puede generar hasta 750 tokens por segundo. Los tokens son las pequeñas unidades de texto que el modelo produce, como palabras, partes de palabras o signos.
Más velocidad sin elegir un modelo más pequeño
Hasta ahora, cuando una empresa necesitaba respuestas prácticamente en tiempo real, normalmente tenía que usar un modelo más pequeño o especializado. Ultrafast intenta reducir ese intercambio: mantener la capacidad de un modelo avanzado mientras disminuye el tiempo de espera.
Eso importa especialmente cuando la respuesta debe llegar mientras una situación sigue cambiando. Por ejemplo, durante una caída de un servicio, una herramienta podría leer registros técnicos, revisar cambios recientes en el código y resumir los informes de los ingenieros para ayudar a localizar la causa y preparar una solución.
OpenAI también señala otros usos posibles:
- Respuesta a incidentes: analizar registros, trazas y conversaciones para decidir las siguientes comprobaciones durante una interrupción.
- Investigación financiera y seguridad: revisar señales del mercado, evaluar transacciones y detectar actividad sospechosa mientras los datos evolucionan.
- Atención al cliente y voz: resolver problemas complejos en tiempo real sin cortar la conversación para buscar información en varios sistemas.
- Comercio electrónico: responder dudas sobre productos, comprobar existencias, personalizar recomendaciones y resolver problemas de pago antes de que el cliente abandone la compra.
- Investigación y experimentación: convertir procesos que antes requerían esperar toda la noche en ciclos interactivos de prueba, análisis y ajuste durante la jornada.
Qué cambia en la práctica
La diferencia no consiste solo en que una respuesta aparezca antes. También puede cambiar cómo se diseñan los productos y el trabajo diario.
Un equipo de investigación podría lanzar un experimento, revisar los resultados, modificar la hipótesis y ejecutar otra prueba sin romper el ritmo. Un equipo de soporte podría consultar varias fuentes mientras el cliente sigue hablando. Y un ingeniero podría pasar más rápido de detectar una alerta a comprobar una posible solución.
OpenAI afirma que sus propios equipos ya están probando Ultrafast en respuesta a incidentes e investigación. En esos procesos, el modelo ayuda a leer información, organizarla y sugerir los siguientes pasos, pero los ingenieros siguen siendo responsables de evaluar las decisiones y desplegar los cambios.
Ultrafast genera hasta 750 tokens por segundo.
Todavía es una vista previa
El servicio no está disponible de forma general. OpenAI lo está evaluando con empresas de programación, comercio, investigación financiera, atención al cliente y otras aplicaciones interactivas. La compañía usará esos resultados para decidir dónde aporta más valor y cómo ampliar el acceso a medida que aumente la capacidad.
Para ti, el efecto inmediato es limitado si no desarrollas productos con la API de OpenAI. Pero la dirección es clara: la IA empieza a competir no solo por lo que puede responder, sino por si puede hacerlo a la velocidad de una conversación, una compra o una emergencia operativa. El siguiente punto que habrá que vigilar es cuánto costará esa velocidad y en qué situaciones compensa pagar por ella.