xAI lanza Grok 4.6 para agentes de IA
xAI lanza Grok 4.6 con mejoras para agentes de IA capaces de investigar, programar y crear aplicaciones durante tareas largas. El modelo ya está disponible en Cursor, Grok Build, la API y varias plataformas, con precios desde 2 dólares por millón de tokens de entrada.

xAI ha lanzado Grok 4.6, un modelo de IA diseñado para mantener tareas largas con menos interrupciones: investigar un tema, trabajar sobre una base de código o convertir una idea en una aplicación funcional y visualmente cuidada.
La compañía lo presenta como una evolución de Grok 4.5, con mejoras centradas en el trabajo con varios pasos y en proyectos interactivos. Ya está disponible en Cursor y Grok Build, además de la API y plataformas como OpenRouter, Vercel y Cloudflare.
Qué puede hacer Grok 4.6
Grok 4.6 está pensado para no detenerse después de generar una primera respuesta. En un proyecto de software, por ejemplo, puede investigar un área que no conoce, organizar la aplicación, implementar sus interacciones principales y seguir haciendo cambios tras recibir comentarios.
Según xAI, el modelo también muestra más capacidad para revisar su propio trabajo. En tareas largas, puede probar lo que ha creado y verificar algunos resultados antes de continuar. Eso no significa que sea infalible, pero reduce uno de los problemas habituales de los agentes de IA: avanzar durante muchos pasos sin detectar un error inicial.
La mejora también alcanza a los proyectos visuales e interactivos. Ante una idea concreta de producto, Grok 4.6 puede generar una primera versión con una estructura y un estilo visual definidos, para después perfeccionarla mediante varias rondas de edición.
Rendimiento y entrenamiento
xAI afirma que Grok 4.6 alcanza un nivel de referencia en varias pruebas de programación con agentes y tareas de conocimiento. En el Artificial Analysis Intelligence Index, un índice compuesto por nueve evaluaciones, iguala la puntuación de GPT-5.6 Sol.
El modelo recibió un entrenamiento adicional más largo que Grok 4.5. xAI combinó datos generados y seleccionados por modelos sobre razonamiento y conceptos técnicos avanzados con información de ingeniería, además de un optimizador y una receta de entrenamiento mejorados.
Después utilizó Grok 4.5 para volver a generar ejemplos de entrenamiento en distintas áreas, como ciencia, tecnología, programación y trabajo de conocimiento. También filtró trazas problemáticas mediante comprobaciones automáticas. El entrenamiento posterior con aprendizaje por refuerzo incluyó tareas de desarrollo web, optimización de kernels y diseño asistido por ordenador, entre otras.
Precio y disponibilidad
Durante la primera semana, Grok Build y Cursor ofrecen el doble del uso incluido para probar Grok 4.6. En la API, el precio comienza en:
- 2 dólares por cada millón de tokens de entrada, es decir, el texto y los datos que recibe el modelo.
- 6 dólares por cada millón de tokens de salida, el contenido que genera.
- Una variante rápida con un precio equivalente al doble.
Para ti, el cambio más relevante está en el tipo de tareas que el modelo intenta resolver. No se limita a contestar una pregunta o escribir un fragmento de código: busca sostener un proyecto durante más tiempo. Aun así, conviene revisar sus resultados, especialmente cuando toma decisiones técnicas o produce aplicaciones completas.
xAI también asegura haber ampliado sus pruebas de seguridad antes y después del lanzamiento, con evaluaciones propias y de terceros. El siguiente punto que habrá que vigilar es si esa capacidad para trabajar durante más pasos se traduce en resultados fiables fuera de las demostraciones y en proyectos reales.