Grok Beta
xAIGrok
Fecha de lanzamiento
2024-08-13
Parámetros
—
Longitud del contexto
—
Modalidades
—
Radar de capacidades
26
general
25
coding
37
reasoning
32
scienceest.
33
agents
90
multimodal
Science usa un proxy de razonamiento cuando los benchmarks científicos dedicados no están disponibles.
Rankings
| Dominio | #Posición | Puntuación | Fuente |
|---|---|---|---|
| Ranking de codificación | 317 | 26.0 | AA |
| Ranking general | 337 | 33.0 | AA |
| Razonamiento matemático | 216 | 42.0 | AA |
| Ciencia | 351 | 33.0 | AA |
Puntuaciones de benchmarks (LLM Stats)
Biology
GPQA
56.0%Aut.
Code
HumanEval
88.4%Aut.
Finance
MMLU
87.5%Aut.
MMLU-Pro
75.5%Aut.
General
MMMU
66.1%Aut.
Image To Text
DocVQA
93.6%Aut.
Math
MATH
76.1%Aut.
MathVista
69.0%Aut.
Índices de evaluación AA
Intelligence Index7.5
Math 5000.7
Mmlu Pro0.7
Gpqa0.5
Scicode0.3
Livecodebench0.2
Aime0.1
Hle0.0
Puntuaciones por categoría LLM Stats
Image To Text90
Code90
Language80
Legal80
Math80
Multimodal80
Finance80
Healthcare80
Vision80
Reasoning70
General70
Physics60
Biology60
Chemistry60
Precios
Precio de entradaGratis
Precio de salidaGratis
Precio mixto (3:1)Gratis
Velocidad
Tokens/seg0.0
Retraso del primer token0.00s
Tiempo hasta la respuesta0.00s
Ranking de Precios por Proveedor
Ranking de Precios por Proveedor
1 proveedores
ProveedorEntradaSalida
1NanoGPT
$1.25
$2.5
Comparar precios entre diferentes proveedores de API para este modelo.