Grok-1.5 mejora el razonamiento y procesa más contexto
xAI presenta Grok-1.5, un modelo con mejores resultados en matemáticas y programación y una ventana de contexto de hasta 128.000 tokens. Su lanzamiento será gradual para evaluadores y usuarios actuales de Grok en 𝕏.

xAI ha presentado Grok-1.5, una nueva versión de su modelo de inteligencia artificial con mejores resultados en matemáticas, programación y comprensión de textos largos. La compañía planea ofrecerlo primero a usuarios actuales de Grok y a un grupo de evaluadores en los días posteriores al anuncio.
Más capacidad para resolver problemas
La mejora más clara aparece en tareas de razonamiento. En las pruebas publicadas por xAI, Grok-1.5 obtuvo:
- 50,6% en MATH, una evaluación de problemas matemáticos de nivel escolar y preuniversitario.
- 90% en GSM8K, otra prueba centrada en problemas matemáticos.
- 74,1% en HumanEval, que mide la capacidad para generar código y resolver problemas de programación.
Son resultados de pruebas concretas, no una garantía de que el modelo vaya a acertar siempre. Además, las comparaciones entre modelos deben leerse con cuidado porque cada evaluación puede usar un número distinto de ejemplos, instrucciones y condiciones.
En la tabla de xAI, Grok-1.5 queda por encima de Grok-1 en todas esas mediciones. En MATH, por ejemplo, pasa del 23,9% al 50,6%. En GSM8K sube del 62,9% al 90%.
Puede leer documentos mucho más largos
Grok-1.5 amplía su ventana de contexto hasta 128.000 tokens. El contexto es la cantidad de texto que un modelo puede tener en cuenta durante una conversación o una tarea. Según xAI, esta capacidad multiplica por 16 la longitud disponible en la versión anterior.
En la práctica, esto permite trabajar con documentos extensos sin tener que dividirlos en muchas partes. Por ejemplo, podrías pedirle que compare varios capítulos de un informe, encuentre una cláusula concreta en un contrato largo o revise un proyecto de código con muchos archivos.
xAI también afirma que Grok-1.5 recuperó correctamente información escondida en textos de hasta 128.000 tokens durante la prueba Needle In A Haystack. Esa evaluación mide si el modelo puede localizar un dato específico dentro de un volumen muy grande de texto.
La llegada será gradual
Grok-1.5 no se abre de inmediato a todo el público. xAI indica que primero llegará a evaluadores iniciales y a los usuarios que ya tienen acceso a Grok en la plataforma 𝕏. Después, la compañía prevé ampliar la disponibilidad y añadir nuevas funciones.
El modelo se entrenó con una infraestructura propia basada en JAX, Rust y Kubernetes. Entre otras cosas, el sistema puede detectar servidores problemáticos y retirarlos automáticamente durante el entrenamiento, además de reiniciar el proceso con menos tiempo perdido.
Para ti, la novedad más práctica no es solo que Grok obtenga mejores puntuaciones. Es que puede mantener más información activa mientras trabaja. Eso puede traducirse en mejores resultados al analizar documentos largos, escribir o revisar código y resolver tareas con varios pasos, aunque habrá que comprobar su rendimiento en el uso diario cuando más personas tengan acceso.
Grok-1.5 marca la dirección que sigue la competencia entre modelos de IA: no solo responder preguntas, sino trabajar con más información y sostener tareas complejas durante más tiempo. Lo importante ahora será ver si las mejoras de laboratorio se mantienen en conversaciones y trabajos reales.