Modelos IA

El Explorador de Modelos de IA

Dos rankings: cada modelo ordenado por inteligencia por dólar, y por qué tan bien busca en la web, frente a lo que cuesta realmente ejecutar una tarea.

Última actualización: 31 de agosto de 2026 · Fuente: https://artificialanalysis.ai/

Mejor calidad-precio

GPT-5.6 Luna (max)

OpenAI

El modelo más barato que conserva inteligencia cercana a la frontera

Inteligencia
52.3
Búsqueda web
54.6
Costo/tarea
$0.049

GPT-5.6 Luna (max) obtiene 52.3 de inteligencia a $0.049 por tarea, 48x más barato que el líder Claude Opus 5 (max).

Mejor para búsqueda web

GLM-5.3-Flash

Z AI

El mejor investigador web al menor costo

Búsqueda web
94.2
Inteligencia
57.5
Costo/tarea
$0.087

GLM-5.3-Flash lidera la búsqueda web con 94.2, con 57.5 de inteligencia por solo $0.087 por tarea. Más inteligente que el de mejor valor y casi igual de barato.

Mejor relación calidad-precio ahora

GPT-5.6 Luna (max)

OpenAI

El modelo más barato que aún conserva inteligencia cercana a la frontera

Inteligencia
52.3
Costo/tarea
$0.049
Entrada
$0.20/M tokens
Salida
$1.20/M tokens
Velocidad
129 tok/s
Búsqueda web
54.6
Puntaje de valor
1074.3

Por qué este

GPT-5.6 Luna (max) obtiene 52.3 en el Índice de Inteligencia, 83% del líder Claude Opus 5 (max), y cuesta $0.049 por tarea. Eso es 48x más barato que el líder. Está en la frontera de Pareto, así que ningún modelo es a la vez más inteligente y más barato.

Mejor para búsqueda web ahora

GLM-5.3-Flash

Z AI

El investigador web más inteligente al menor costo

Búsqueda web
94.2
Inteligencia
57.5
Costo/tarea
$0.087
Contexto
1M
Más preciso (menos alucinaciones)
72%

Por qué este

GLM-5.3-Flash obtiene 94.2 en el benchmark de investigación profunda, el más alto de la tabla, mientras conserva 57.5 de inteligencia general y cuesta solo $0.087 por tarea. Para trabajo intensivo de búsqueda supera a modelos mucho más caros por una fracción del costo.

Qué cambió

Desde el análisis anterior

Nada cambió desde el último análisis.

Más inteligencia por dólar

Ordenados por Índice de Inteligencia frente a lo que cuesta realmente una tarea completa.

ModeloProveedorInteligenciaCosto/tareaEntradaSalidaVelocidadPuntaje de valor
Claude Opus 5 (max)Mejor en su claseAnthropic63.0$2.34$5.00$25.005327.0
Claude Fable 5 (with fallback)Claude Opus 5 (max) es más inteligente y más baratoAnthropic62.1$3.14$10.00$50.006719.8
GPT-5.6 Sol (max)Mejor en su claseOpenAI60.9$0.95$4.00$20.007963.9
Grok 4.6 (high)Mejor en su claseSpaceXAI60.9$0.94$2.00$6.005965.0
Kimi K3 (max)Mejor en su claseKimi59.7$0.84$3.00$15.004071.3
GLM-5.3 (max)Mejor en su claseZ AI59.5$0.68$1.40$4.407887.1
Qwen3.8 2.4T A95BGLM-5.3 (max) es más inteligente y más baratoAlibaba57.7$0.81$2.00$6.00sin dato71.5
GLM-5.3-FlashMejor en su claseZ AI57.5$0.087$0.15$0.50sin dato661.2
Muse Spark 1.2 (xhigh)GLM-5.3-Flash es más inteligente y más baratoMeta56.8$0.40$1.25$4.25sin dato142.2
GPT-5.6 Terra (max)GLM-5.3-Flash es más inteligente y más baratoOpenAI56.6$0.53$2.00$12.00122107.6
Gemini 3.7 Flash (high)GLM-5.3-Flash es más inteligente y más baratoGoogle56.0$0.40$0.75$3.75315139.3
DeepSeek V4 Pro 0813 (max)GLM-5.3-Flash es más inteligente y más baratoDeepSeek53.2$0.27$1.32$3.9654200.5
GPT-5.6 Luna (max)Mejor calidad-precioOpenAI52.3$0.049$0.20$1.201291074.3
Qwen3.8 27B (xhigh)GLM-5.3-Flash es más inteligente y más baratoAlibaba52.0$0.37$0.50$3.0047141.0
Motif 3Motif Technologies47.4sin datosin datosin datosin datosin dato
MiniMax-M3GLM-5.3-Flash es más inteligente y más baratoMiniMax45.4$0.14$0.30$1.20150327.3
InklingGLM-5.3-Flash es más inteligente y más baratoThinking Machines42.3$0.34$1.00$4.0577124.8
Nemotron 3 UltraGLM-5.3-Flash es más inteligente y más baratoNVIDIA38.3$0.38$0.60$2.7570100.1
Gemini 3.5 Flash-LiteGLM-5.3-Flash es más inteligente y más baratoGoogle37.4$0.097$0.30$2.50358388.0
Solar Open2 250BUpstage37.4sin datosin datosin datosin datosin dato

Mejor en búsqueda web

Ordenados por el benchmark de investigación profunda: qué tan bien cada modelo busca y sintetiza la web.

ModeloProveedorBúsqueda webInteligenciaCosto/tareaEntradaSalidaContexto
GLM-5.3-FlashMejor investigadorZ AI94.257.5$0.087$0.15$0.501M
GLM-5.3 (max)Z AI93.959.5$0.68$1.40$4.401M
Grok 4.6 (high)SpaceXAI90.660.9$0.94$2.00$6.00500K
Qwen3.8 2.4T A95BAlibaba87.757.7$0.81$2.00$6.00984K
Qwen3.8 27B (xhigh)Alibaba84.052.0$0.37$0.50$3.00256K
Muse Spark 1.2 (xhigh)Meta83.056.8$0.40$1.25$4.251M
Claude Opus 5 (max)Anthropic81.863.0$2.34$5.00$25.001M
Kimi K3 (max)Kimi78.459.7$0.84$3.00$15.001M
Claude Fable 5 (with fallback)Anthropic77.062.1$3.14$10.00$50.001M
MiniMax-M3MiniMax76.045.4$0.14$0.30$1.201M
GPT-5.6 Sol (max)OpenAI65.360.9$0.95$4.00$20.001M
Gemini 3.7 Flash (high)Google64.356.0$0.40$0.75$3.751M
Nemotron 3 UltraNVIDIA61.338.3$0.38$0.60$2.75262K
GPT-5.6 Terra (max)OpenAI59.356.6$0.53$2.00$12.001M
Gemini 3.5 Flash-LiteGoogle58.037.4$0.097$0.30$2.501M
DeepSeek V4 Pro 0813 (max)DeepSeek56.153.2$0.27$1.32$3.961M
GPT-5.6 Luna (max)OpenAI54.652.3$0.049$0.20$1.201M
InklingThinking Machines50.842.3$0.34$1.00$4.051M

Los precios por token son USD por millón de tokens. El costo por tarea es el costo en USD de una ejecución completa del Índice de Inteligencia. La velocidad es en tokens de salida por segundo. Búsqueda web es el puntaje del benchmark de investigación profunda, y contexto es la ventana máxima en tokens.

De un vistazo

Mayor inteligencia:
Claude Opus 5 (max) (63.0)
Mejor en búsqueda web:
GLM-5.3-Flash (94.2)
Más preciso (menos alucinaciones):
MiniMax-M3 (82%)
Salida más rápida:
GPT-5.6 Luna (max)
Menor costo por tarea:
GPT-5.6 Luna (max)
Costo promedio por tarea:
$0.71
En la frontera de Pareto:
7 de 20 modelos

Cómo se ordena esto

El puntaje de valor es el Índice de Inteligencia dividido entre el costo por tarea. El mejor valor es el modelo más barato que aún alcanza al menos 50.4, o sea el 80% del líder Claude Opus 5 (max). Las cifras vienen directo de los datasets publicados por la fuente, no de un resumen hecho por IA.

Preguntas frecuentes

¿Cómo se elige el modelo con mejor relación calidad-precio?

Tomamos todos los modelos que alcanzan al menos el 80% del Índice de Inteligencia más alto de la tabla y elegimos el más barato por costo por tarea. Ese umbral evita que gane un modelo barato pero débil solo por precio.

¿Qué modelo es mejor para búsqueda web?

Ordenamos por el benchmark de investigación profunda, que mide qué tan bien un modelo reúne, cita y sintetiza información de la web, y tomamos al líder. El campeón de búsqueda web suele ser un modelo distinto y más barato que el líder de inteligencia pura: más inteligente investigando y mucho más económico de ejecutar.

¿Por qué costo por tarea y no precio por token?

Los modelos de razonamiento consumen grandes cantidades de tokens de pensamiento ocultos, así que un precio bajo por token puede producir una petición cara. El costo por tarea mide lo que cuesta realmente una ejecución completa, que es lo que terminas pagando.

¿De dónde salen estos números?

Directamente de los datasets de benchmarks que Artificial Analysis publica junto con sus gráficas. Los leemos como datos en vez de pedirle a un modelo de lenguaje que los transcriba, así que las cifras coinciden exactamente con la fuente.

¿Qué significa la frontera de Pareto aquí?

Un modelo está en la frontera cuando ningún otro es a la vez más inteligente y más barato que él. Lo que queda fuera de la frontera está estrictamente superado por otro modelo, y te decimos cuál.