Ranking de modelos de inteligencia artificial.
Índices de Artificial Analysis — inteligencia, código y agentic (0–100) — obtenidos vía la API pública de OpenRouter.
Capacidad general de razonamiento, comprensión y precisión en tareas complejas. El índice principal del ranking.
Habilidad para generar, depurar y optimizar código fuente en distintos lenguajes de programación.
Capacidad para ejecutar tareas autónomas: seguir instrucciones, usar herramientas y razonar en varios pasos.
Costo por millón de tokens de salida. En el radar precio vs. inteligencia, arriba a la izquierda es más inteligencia por dólar.
Inteligencia
Código
Agentic
Los 8 modelos más inteligentes, comparados en las tres dimensiones. Escala 0–100 en los tres paneles.
Arriba a la izquierda = más inteligencia por dólar. Eje X logarítmico.
| # | Modelo | Intelligence | Coding | Agentic | Contexto | USD/1M (in/out) |
|---|---|---|---|---|---|---|
| ★ | Claude Opus 5 anthropic/claude-opus-5 | 60.7 | 78.0 | 55.3 | 1.0M | $5.00 / $25.00 |
| 02 | Anthropic: Claude Fable 5 anthropic/claude-fable-5 | 59.9 | 76.5 | 52.8 | 1.0M | $10.00 / $50.00 |
| 03 | OpenAI: GPT-5.6 Sol openai/gpt-5.6-sol | 58.9 | 77.4 | 54.0 | 1.1M | $5.00 / $30.00 |
| 04 | MoonshotAI: Kimi K3 moonshotai/kimi-k3 | 57.1 | 76.2 | 50.1 | 1.0M | $3.00 / $15.00 |
| 05 | Anthropic: Claude Opus 4.8 anthropic/claude-opus-4.8 | 55.7 | 74.3 | 47.2 | 1.0M | $5.00 / $25.00 |
| 06 | OpenAI: GPT-5.6 Terra openai/gpt-5.6-terra | 55.0 | 76.7 | 47.4 | 1.1M | $2.50 / $15.00 |
| 07 | OpenAI: GPT-5.5 openai/gpt-5.5 | 54.8 | 74.9 | 44.9 | 1.1M | $5.00 / $30.00 |
| 08 | xAI: Grok 4.5 x-ai/grok-4.5 | 53.8 | 72.4 | 45.7 | 500K | $2.00 / $6.00 |
| 09 | Anthropic: Claude Opus 4.7 anthropic/claude-opus-4.7 | 53.5 | 73.6 | 44.4 | 1.0M | $5.00 / $25.00 |
| 10 | Anthropic: Claude Sonnet 5 anthropic/claude-sonnet-5 | 53.4 | 71.5 | 46.7 | 1.0M | $2.00 / $10.00 |
| 11 | OpenAI: GPT-5.4 openai/gpt-5.4 | 51.4 | 71.1 | 41.1 | 1.1M | $2.50 / $15.00 |
| 12 | OpenAI: GPT-5.6 Luna openai/gpt-5.6-luna | 51.2 | 71.4 | 45.6 | 1.1M | $1.00 / $6.00 |
| 13 | Z.ai: GLM 5.2 z-ai/glm-5.2 | 51.1 | 68.8 | 43.1 | 1.0M | $0.70 / $2.20 |
| 14 | Meta: Muse Spark 1.1 meta/muse-spark-1.1 | 50.6 | 71.3 | 37.5 | 1.0M | $1.25 / $4.25 |
| 15 | Google: Gemini 3.5 Flash google/gemini-3.5-flash | 50.2 | 70.1 | 37.4 | 1.0M | $1.50 / $9.00 |
| 16 | Google: Gemini 3.6 Flash google/gemini-3.6-flash | 50.1 | 69.2 | 38.7 | 1.0M | $1.50 / $7.50 |
| 17 | Anthropic: Claude Sonnet 4.6 anthropic/claude-sonnet-4.6 | 47.2 | 63.0 | 40.8 | 1.0M | $3.00 / $15.00 |
| 18 | Google: Gemini 3.1 Pro Preview google/gemini-3.1-pro-preview | 46.5 | 68.8 | 21.4 | 1.0M | $2.00 / $12.00 |
| 19 | Qwen: Qwen3.7 Max qwen/qwen3.7-max | 46.0 | 66.0 | 30.6 | 1.0M | $1.48 / $4.42 |
| 20 | MiniMax: MiniMax M3 minimax/minimax-m3 | 44.4 | 58.6 | 35.4 | 1.0M | $0.30 / $1.20 |
Cómo se construye este radar
Los datos provienen de la API pública de OpenRouter, que expone los índices de Artificial Analysis. Hoy el JSON se regenera a mano; pronto un workflow lo automatizará cada semana.