Grok 4.5 (high)
SpaceXAIGrokProprietary
Description
Grok 4.5 is SpaceXAI's frontier model for coding, agentic tasks, and knowledge work. Trained alongside Cursor across tens of thousands of NVIDIA GB300 GPUs, it uses large-scale reinforcement learning focused on multi-step software engineering and other technical work. The model supports text and image inputs, reasoning, function calling, structured outputs, and a 500K-token context window, and is served at 80 tokens per second.
Date de sortie
2026-07-08
Paramètres
—
Longueur du contexte
500K
Modalités
image, pdf, text
Radar de capacités
53
general
70
coding
93
reasoning
69
science
60
agents
80
multimodal
Classements
| Domaine | #Rang | Score | Source |
|---|---|---|---|
| Capacité agentique | 24 | 58.0 | LS |
| Classement codage | 28 | 91.0 | AA |
| Classement général | 19 | 88.0 | AA |
| Raisonnement mathématique | 16 | 91.0 | LB |
| Raisonnement | 16 | 87.0 | LB |
| Science | 24 | 88.0 | AA |
Scores de benchmarks (LLM Stats)
(LLM Stats (zeroeval))Agents
AutomationBench-AA
51.4%
Tau3 Banking
33.0%
Code
DeepSWE 1.0
62.0%Aut.
DeepSWE 1.1
54.0%
DeepSWE
53.0%Aut.
SWE-Marathon
29.0%Aut.
General
Artificial Analysis
54.0%
Knowledge
AA-Omniscience Index
126.00 / 200
OmniScience (non-hallucination rate)
46.0%
Reasoning
GPQANYU + Cohere + Anthropic (2023)
93.0%
Terminal-Bench 2.1
83.3%Aut.
SWE-Bench ProPrinceton NLP (2024)
64.7%Aut.
FrontierCode 1.1
42.4%
Science
OmniScience
52.0%
Indices d'évaluation AA
(Artificial Analysis)Coding Index(Artificial Analysis)72.4
Intelligence Index(Artificial Analysis)55.8
Gpqa(NYU + Cohere + Anthropic (2023))0.9
Terminalbench V2 10.8
Lcr(Artificial Analysis)0.7
Scicode(UIUC + Argonne National Lab (2024))0.5
Hle(Center for AI Safety + Scale AI (2025))0.4
Tau Banking0.4
Scores par catégorie LLM Stats
(LLM Stats (zeroeval))Physics90
Biology90
Chemistry90
Reasoning60
General60
Tool Calling60
Science50
Knowledge50
Agents50
Code50
Tarification
Prix d'entrée$2 / 1M tokens
Prix de sortie$6 / 1M tokens
Prix mixte (3:1)$3 / 1M tokens
Prix de lecture cache$0.3 / 1M tokens
Vitesse
Tokens/sec55.3
Délai du premier token9.67s
Temps de réponse9.67s
Classement des Prix par Fournisseur
Classement des Prix par Fournisseur
18 fournisseurs
Moins cher: xAIPlus cher: Venice AI
FournisseurEntréeSortie
1xAIMoins cher
$0
$0.00001
2Requesty
$1.8
$5.4
3SpaceXAIPRINCIPAL
$2
$6
4NanoGPT
$2
$6
5Abacus
$2
$6
6OpenRouter
$2
$6
7OpenCode Go
$2
$6
8ZenMux
$2
$6
9Kilo Gateway
$2
$6
10GitHub Copilot
$2
$6
11OpenCode Zen
$2
$6
12AIHubMix
$2
$6
13DevPass (LLM Gateway)
$2
$6
14CrossModel
$2
$6
15Pioneer
$2
$6
16DaoXE
$2
$6
17Ofox
$2
$6
18Venice AI
$2.27
$6.8
Comparer les prix entre différents fournisseurs API pour ce modèle.