Saltar al contenido principal
AITier
Inicio
Rankings
Modelos
Proveedores
Widgets
Prueba
ES
Buscar modelos / rankings / escenarios
Ranking de modelos de IA
Explore y compare modelos de IA con rankings detallados en múltiples dominios
Volver al inicio
Ranking general
Ranking de codificación
Razonamiento matemático
Ciencia
Razonamiento
Capacidad agéntica
Ranking multimodal
Generación de imágenes
Texto a video
Imagen a video
Audio
Posición
Modelo
Puntuación
Posición
Modelo
Puntuación
2
Claude Opus 5.5 (Adaptive Reasoning, Low Effort, Default Fallback)
97.0
3
Claude Opus 5.5 (Adaptive Reasoning, Low Effort, Default Fallback)
97.0
4
GPT-6 Astra (low)
97.0
1
Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback)
97.0
5
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
96.0
6
Claude Opus 5 (Adaptive Reasoning, Low Effort)
96.0
7
GPT-5.5 (Non-reasoning)
96.0
8
GPT-5.6 Sol (Non-reasoning)
96.0
9
GPT-6 Sol (Non-reasoning)
96.0
10
Grok 4.7 (high)
96.0
11
Muse Spark 1.3 (xhigh)
96.0
12
GPT-5.6 Terra (Non-reasoning)
95.0
13
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
94.0
14
GPT-5.4 (Non-reasoning)
94.0
15
Claude Opus 4.7 (Non-reasoning, High Effort)
93.0
16
Claude Sonnet 5 (Non-reasoning, High Effort)
93.0
17
DeepSeek V4.1 Flash (Non-Reasoning)
93.0
18
Gemini 3.7 Flash (low)
93.0
19
GPT-5.2 (Non-reasoning)
93.0
20
Grok 4.6 (low)
93.0
51 elementos
1
2
3
20 / page
Fuente de datos: LiveBench (Abacus.AI, NYU, NVIDIA, UMD, USC, Columbia) · Mathematics (category) (lanzamiento 2026-06-25)
· Actualizado: 2026-09-25