Grok Beta
xAIGrok
Date de sortie
2024-08-13
Paramètres
—
Longueur du contexte
—
Modalités
—
Radar de capacités
26
general
25
coding
37
reasoning
32
scienceest.
33
agents
90
multimodal
Science utilise un proxy de raisonnement lorsque les benchmarks scientifiques dédiés ne sont pas disponibles.
Classements
| Domaine | #Rang | Score | Source |
|---|---|---|---|
| Classement codage | 317 | 26.0 | AA |
| Classement général | 337 | 33.0 | AA |
| Raisonnement mathématique | 216 | 42.0 | AA |
| Science | 351 | 33.0 | AA |
Scores de benchmarks (LLM Stats)
Biology
GPQA
56.0%Aut.
Code
HumanEval
88.4%Aut.
Finance
MMLU
87.5%Aut.
MMLU-Pro
75.5%Aut.
General
MMMU
66.1%Aut.
Image To Text
DocVQA
93.6%Aut.
Math
MATH
76.1%Aut.
MathVista
69.0%Aut.
Indices d'évaluation AA
Intelligence Index7.5
Math 5000.7
Mmlu Pro0.7
Gpqa0.5
Scicode0.3
Livecodebench0.2
Aime0.1
Hle0.0
Scores par catégorie LLM Stats
Image To Text90
Code90
Language80
Legal80
Math80
Multimodal80
Finance80
Healthcare80
Vision80
Reasoning70
General70
Physics60
Biology60
Chemistry60
Tarification
Prix d'entréeGratuit
Prix de sortieGratuit
Prix mixte (3:1)Gratuit
Vitesse
Tokens/sec0.0
Délai du premier token0.00s
Temps de réponse0.00s
Classement des Prix par Fournisseur
Classement des Prix par Fournisseur
1 fournisseurs
FournisseurEntréeSortie
1NanoGPT
$1.25
$2.5
Comparer les prix entre différents fournisseurs API pour ce modèle.