El Explorador de Modelos de IA
Dos rankings: cada modelo ordenado por inteligencia por dólar, y por qué tan bien busca en la web, frente a lo que cuesta realmente ejecutar una tarea.
Última actualización: 31 de agosto de 2026 · Fuente: https://artificialanalysis.ai/
GPT-5.6 Luna (max)
OpenAIEl modelo más barato que conserva inteligencia cercana a la frontera
- Inteligencia
- 52.3
- Búsqueda web
- 54.6
- Costo/tarea
- $0.049
GPT-5.6 Luna (max) obtiene 52.3 de inteligencia a $0.049 por tarea, 48x más barato que el líder Claude Opus 5 (max).
GLM-5.3-Flash
Z AIEl mejor investigador web al menor costo
- Búsqueda web
- 94.2
- Inteligencia
- 57.5
- Costo/tarea
- $0.087
GLM-5.3-Flash lidera la búsqueda web con 94.2, con 57.5 de inteligencia por solo $0.087 por tarea. Más inteligente que el de mejor valor y casi igual de barato.
Mejor relación calidad-precio ahora
GPT-5.6 Luna (max)
OpenAIEl modelo más barato que aún conserva inteligencia cercana a la frontera
- Inteligencia
- 52.3
- Costo/tarea
- $0.049
- Entrada
- $0.20/M tokens
- Salida
- $1.20/M tokens
- Velocidad
- 129 tok/s
- Búsqueda web
- 54.6
- Puntaje de valor
- 1074.3
Por qué este
GPT-5.6 Luna (max) obtiene 52.3 en el Índice de Inteligencia, 83% del líder Claude Opus 5 (max), y cuesta $0.049 por tarea. Eso es 48x más barato que el líder. Está en la frontera de Pareto, así que ningún modelo es a la vez más inteligente y más barato.
Mejor para búsqueda web ahora
GLM-5.3-Flash
Z AIEl investigador web más inteligente al menor costo
- Búsqueda web
- 94.2
- Inteligencia
- 57.5
- Costo/tarea
- $0.087
- Contexto
- 1M
- Más preciso (menos alucinaciones)
- 72%
Por qué este
GLM-5.3-Flash obtiene 94.2 en el benchmark de investigación profunda, el más alto de la tabla, mientras conserva 57.5 de inteligencia general y cuesta solo $0.087 por tarea. Para trabajo intensivo de búsqueda supera a modelos mucho más caros por una fracción del costo.
Qué cambió
Desde el análisis anterior
Nada cambió desde el último análisis.
Más inteligencia por dólar
Ordenados por Índice de Inteligencia frente a lo que cuesta realmente una tarea completa.
| Modelo | Proveedor | Inteligencia | Costo/tarea | Entrada | Salida | Velocidad | Puntaje de valor |
|---|---|---|---|---|---|---|---|
| Claude Opus 5 (max)Mejor en su clase | Anthropic | 63.0 | $2.34 | $5.00 | $25.00 | 53 | 27.0 |
| Claude Fable 5 (with fallback)Claude Opus 5 (max) es más inteligente y más barato | Anthropic | 62.1 | $3.14 | $10.00 | $50.00 | 67 | 19.8 |
| GPT-5.6 Sol (max)Mejor en su clase | OpenAI | 60.9 | $0.95 | $4.00 | $20.00 | 79 | 63.9 |
| Grok 4.6 (high)Mejor en su clase | SpaceXAI | 60.9 | $0.94 | $2.00 | $6.00 | 59 | 65.0 |
| Kimi K3 (max)Mejor en su clase | Kimi | 59.7 | $0.84 | $3.00 | $15.00 | 40 | 71.3 |
| GLM-5.3 (max)Mejor en su clase | Z AI | 59.5 | $0.68 | $1.40 | $4.40 | 78 | 87.1 |
| Qwen3.8 2.4T A95BGLM-5.3 (max) es más inteligente y más barato | Alibaba | 57.7 | $0.81 | $2.00 | $6.00 | sin dato | 71.5 |
| GLM-5.3-FlashMejor en su clase | Z AI | 57.5 | $0.087 | $0.15 | $0.50 | sin dato | 661.2 |
| Muse Spark 1.2 (xhigh)GLM-5.3-Flash es más inteligente y más barato | Meta | 56.8 | $0.40 | $1.25 | $4.25 | sin dato | 142.2 |
| GPT-5.6 Terra (max)GLM-5.3-Flash es más inteligente y más barato | OpenAI | 56.6 | $0.53 | $2.00 | $12.00 | 122 | 107.6 |
| Gemini 3.7 Flash (high)GLM-5.3-Flash es más inteligente y más barato | 56.0 | $0.40 | $0.75 | $3.75 | 315 | 139.3 | |
| DeepSeek V4 Pro 0813 (max)GLM-5.3-Flash es más inteligente y más barato | DeepSeek | 53.2 | $0.27 | $1.32 | $3.96 | 54 | 200.5 |
| GPT-5.6 Luna (max)Mejor calidad-precio | OpenAI | 52.3 | $0.049 | $0.20 | $1.20 | 129 | 1074.3 |
| Qwen3.8 27B (xhigh)GLM-5.3-Flash es más inteligente y más barato | Alibaba | 52.0 | $0.37 | $0.50 | $3.00 | 47 | 141.0 |
| Motif 3 | Motif Technologies | 47.4 | sin dato | sin dato | sin dato | sin dato | sin dato |
| MiniMax-M3GLM-5.3-Flash es más inteligente y más barato | MiniMax | 45.4 | $0.14 | $0.30 | $1.20 | 150 | 327.3 |
| InklingGLM-5.3-Flash es más inteligente y más barato | Thinking Machines | 42.3 | $0.34 | $1.00 | $4.05 | 77 | 124.8 |
| Nemotron 3 UltraGLM-5.3-Flash es más inteligente y más barato | NVIDIA | 38.3 | $0.38 | $0.60 | $2.75 | 70 | 100.1 |
| Gemini 3.5 Flash-LiteGLM-5.3-Flash es más inteligente y más barato | 37.4 | $0.097 | $0.30 | $2.50 | 358 | 388.0 | |
| Solar Open2 250B | Upstage | 37.4 | sin dato | sin dato | sin dato | sin dato | sin dato |
Mejor en búsqueda web
Ordenados por el benchmark de investigación profunda: qué tan bien cada modelo busca y sintetiza la web.
| Modelo | Proveedor | Búsqueda web | Inteligencia | Costo/tarea | Entrada | Salida | Contexto |
|---|---|---|---|---|---|---|---|
| GLM-5.3-FlashMejor investigador | Z AI | 94.2 | 57.5 | $0.087 | $0.15 | $0.50 | 1M |
| GLM-5.3 (max) | Z AI | 93.9 | 59.5 | $0.68 | $1.40 | $4.40 | 1M |
| Grok 4.6 (high) | SpaceXAI | 90.6 | 60.9 | $0.94 | $2.00 | $6.00 | 500K |
| Qwen3.8 2.4T A95B | Alibaba | 87.7 | 57.7 | $0.81 | $2.00 | $6.00 | 984K |
| Qwen3.8 27B (xhigh) | Alibaba | 84.0 | 52.0 | $0.37 | $0.50 | $3.00 | 256K |
| Muse Spark 1.2 (xhigh) | Meta | 83.0 | 56.8 | $0.40 | $1.25 | $4.25 | 1M |
| Claude Opus 5 (max) | Anthropic | 81.8 | 63.0 | $2.34 | $5.00 | $25.00 | 1M |
| Kimi K3 (max) | Kimi | 78.4 | 59.7 | $0.84 | $3.00 | $15.00 | 1M |
| Claude Fable 5 (with fallback) | Anthropic | 77.0 | 62.1 | $3.14 | $10.00 | $50.00 | 1M |
| MiniMax-M3 | MiniMax | 76.0 | 45.4 | $0.14 | $0.30 | $1.20 | 1M |
| GPT-5.6 Sol (max) | OpenAI | 65.3 | 60.9 | $0.95 | $4.00 | $20.00 | 1M |
| Gemini 3.7 Flash (high) | 64.3 | 56.0 | $0.40 | $0.75 | $3.75 | 1M | |
| Nemotron 3 Ultra | NVIDIA | 61.3 | 38.3 | $0.38 | $0.60 | $2.75 | 262K |
| GPT-5.6 Terra (max) | OpenAI | 59.3 | 56.6 | $0.53 | $2.00 | $12.00 | 1M |
| Gemini 3.5 Flash-Lite | 58.0 | 37.4 | $0.097 | $0.30 | $2.50 | 1M | |
| DeepSeek V4 Pro 0813 (max) | DeepSeek | 56.1 | 53.2 | $0.27 | $1.32 | $3.96 | 1M |
| GPT-5.6 Luna (max) | OpenAI | 54.6 | 52.3 | $0.049 | $0.20 | $1.20 | 1M |
| Inkling | Thinking Machines | 50.8 | 42.3 | $0.34 | $1.00 | $4.05 | 1M |
Los precios por token son USD por millón de tokens. El costo por tarea es el costo en USD de una ejecución completa del Índice de Inteligencia. La velocidad es en tokens de salida por segundo. Búsqueda web es el puntaje del benchmark de investigación profunda, y contexto es la ventana máxima en tokens.
De un vistazo
- Mayor inteligencia:
- Claude Opus 5 (max) (63.0)
- Mejor en búsqueda web:
- GLM-5.3-Flash (94.2)
- Más preciso (menos alucinaciones):
- MiniMax-M3 (82%)
- Salida más rápida:
- GPT-5.6 Luna (max)
- Menor costo por tarea:
- GPT-5.6 Luna (max)
- Costo promedio por tarea:
- $0.71
- En la frontera de Pareto:
- 7 de 20 modelos
Cómo se ordena esto
El puntaje de valor es el Índice de Inteligencia dividido entre el costo por tarea. El mejor valor es el modelo más barato que aún alcanza al menos 50.4, o sea el 80% del líder Claude Opus 5 (max). Las cifras vienen directo de los datasets publicados por la fuente, no de un resumen hecho por IA.
Preguntas frecuentes
¿Cómo se elige el modelo con mejor relación calidad-precio?
Tomamos todos los modelos que alcanzan al menos el 80% del Índice de Inteligencia más alto de la tabla y elegimos el más barato por costo por tarea. Ese umbral evita que gane un modelo barato pero débil solo por precio.
¿Qué modelo es mejor para búsqueda web?
Ordenamos por el benchmark de investigación profunda, que mide qué tan bien un modelo reúne, cita y sintetiza información de la web, y tomamos al líder. El campeón de búsqueda web suele ser un modelo distinto y más barato que el líder de inteligencia pura: más inteligente investigando y mucho más económico de ejecutar.
¿Por qué costo por tarea y no precio por token?
Los modelos de razonamiento consumen grandes cantidades de tokens de pensamiento ocultos, así que un precio bajo por token puede producir una petición cara. El costo por tarea mide lo que cuesta realmente una ejecución completa, que es lo que terminas pagando.
¿De dónde salen estos números?
Directamente de los datasets de benchmarks que Artificial Analysis publica junto con sus gráficas. Los leemos como datos en vez de pedirle a un modelo de lenguaje que los transcriba, así que las cifras coinciden exactamente con la fuente.
¿Qué significa la frontera de Pareto aquí?
Un modelo está en la frontera cuando ningún otro es a la vez más inteligente y más barato que él. Lo que queda fuera de la frontera está estrictamente superado por otro modelo, y te decimos cuál.