xAI lanza Grok 4.1 con mejor conversación y precisión
xAI pone Grok 4.1 a disposición de todos los usuarios en la web, X y sus aplicaciones móviles. La actualización mejora la conversación, la escritura creativa y la interacción emocional, y busca reducir los errores en respuestas informativas. Según xAI, los usuarios prefirieron esta versión en el 64,78% de las comparaciones ciegas frente al Grok anterior.

Grok 4.1 ya está disponible para todos los usuarios de Grok.com, X y las aplicaciones de iOS y Android. El modelo llega de inmediato en el modo automático y también puede elegirse manualmente desde el selector de modelos.
La actualización no se centra solo en responder preguntas más difíciles. xAI ha trabajado especialmente en cómo conversa Grok: busca interpretar mejor las intenciones, mantener una personalidad más coherente y ofrecer respuestas más útiles en interacciones creativas, emocionales y colaborativas.
Qué cambia frente al Grok anterior
Durante dos semanas, xAI probó versiones preliminares de Grok 4.1 en una parte creciente del tráfico real de sus plataformas. Las respuestas se compararon de forma ciega, sin que los evaluadores supieran qué versión había generado cada una.
Según la compañía, los usuarios prefirieron Grok 4.1 frente al modelo anterior en el 64,78% de las comparaciones. La evaluación se realizó con tráfico real de Grok.com, X y las aplicaciones móviles.
La nueva versión también aparece en posiciones destacadas de LMArena, una clasificación pública que compara modelos mediante evaluaciones humanas. En su modo con razonamiento, Grok 4.1 Thinking, cuyo nombre interno es quasarflux, ocupa el primer puesto de Text Arena con 1483 puntos Elo, una medida de rendimiento relativo.
El modelo sin razonamiento, pensado para responder más rápido, alcanza 1465 puntos Elo y ocupa el segundo puesto. xAI afirma que esta versión supera a otros modelos que sí utilizan razonamiento completo. Como referencia, Grok 4 aparece en el puesto 33 de esa clasificación.
Más atención a las conversaciones
xAI también evaluó Grok 4.1 en EQ-Bench3, una prueba que mide capacidades como comprensión emocional, empatía, percepción e interacción interpersonal. El examen utiliza 45 situaciones de roleplay, muchas de ellas desarrolladas durante tres turnos de conversación.
Además, la compañía probó el modelo en Creative Writing v3, un benchmark de escritura creativa con 32 propuestas y tres iteraciones por propuesta. Estas pruebas intentan medir algo que no siempre aparece en los rankings de matemáticas o programación: si una respuesta se siente adecuada, coherente y natural para quien la lee.
Para conseguirlo, xAI aplicó su infraestructura de aprendizaje por refuerzo a aspectos como el estilo, la personalidad, la utilidad y la alineación. También desarrolló métodos para que otros modelos avanzados evalúen automáticamente las respuestas de Grok y ayuden a mejorar el sistema a gran escala.
Menos errores en preguntas informativas
Grok 4.1 también incorpora ajustes para reducir las alucinaciones, es decir, respuestas que presentan datos falsos como si fueran ciertos. xAI afirma que observó una reducción significativa en consultas informativas tomadas de su tráfico de producción.
La empresa midió este aspecto con una muestra estratificada de preguntas reales y con FActScore, una prueba pública formada por 500 preguntas biográficas. El anuncio no proporciona en el texto una cifra única de reducción, por lo que el avance debe entenderse como una mejora observada por xAI, no como una garantía de exactitud.
Para ti, el cambio más visible debería estar en el uso diario: conversaciones menos rígidas, mejor respuesta a mensajes ambiguos o emocionales y menos errores al pedir información. Aun así, Grok 4.1 sigue necesitando verificación cuando la respuesta afecta a decisiones importantes.
La siguiente señal que conviene vigilar es si estas mejoras se mantienen fuera de las evaluaciones internas y en el uso real a gran escala. El acceso ya no es el límite: ahora la prueba será comprobar cuánto mejora la experiencia cuando utilizas Grok para buscar, escribir o conversar.