Saltar al contenido principal
AITier
Inicio
Rankings
Modelos
Proveedores
Widgets
Prueba
ES
Buscar modelos / rankings / escenarios
Ranking de modelos de IA
Explore y compare modelos de IA con rankings detallados en múltiples dominios
Volver al inicio
Ranking general
Ranking de codificación
Razonamiento matemático
Ciencia
Razonamiento
Capacidad agéntica
Ranking multimodal
Generación de imágenes
Texto a video
Imagen a video
Audio
Posición
Modelo
Puntuación
Posición
Modelo
Puntuación
1
GPT-5.6 Sol (low)
92.0
2
Claude Opus 5 (Adaptive Reasoning, Max Effort)
91.0
3
GPT-5.6 Terra (medium)
91.0
4
Grok 4.6 (high)
91.0
5
Kimi K3 (low)
91.0
6
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
90.0
7
GPT-5.5 (medium)
90.0
8
Muse Spark 1.2 (xhigh)
90.0
9
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
89.0
10
Claude Sonnet 5 (Non-reasoning, High Effort)
89.0
11
GPT-5.4 (xhigh)
88.0
12
Muse Spark 1.1 (xhigh)
88.0
13
Qwen3.8 Max
Open
88.0
14
Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
87.0
15
Grok 4.5 (high)
87.0
16
GPT-5.6 Luna (medium)
86.0
17
Gemini 3.6 Flash (high)
85.0
18
Gemini 3.1 Pro Preview
84.0
19
DeepSeek V4 Pro 0813 (Reasoning, Max Effort)
Open
83.0
20
GPT-5.2 (Non-reasoning)
83.0
35 elementos
1
2
20 / page
Fuente de datos: LiveBench (Abacus.AI, NYU, NVIDIA, UMD, USC, Columbia) · Reasoning (category) (lanzamiento 2026-06-25)
· Actualizado: 2026-08-13