Llama 3.1 Tulu3 405B
Allen Institute for AI
Date de sortie
2025-01-30
Paramètres
—
Longueur du contexte
—
Modalités
—
Radar de capacités
26
general
29
coding
40
reasoning
37
science
37
agents
0
multimodal
Classements
| Domaine | #Rang | Score | Source |
|---|---|---|---|
| Classement codage | 415 | 32.0 | AA |
| Classement général | 455 | 31.0 | AA |
| Science | 503 | 26.0 | AA |
Scores de benchmarks (LLM Stats)
(LLM Stats (zeroeval))Aucune donnée de benchmark disponible
Indices d'évaluation AA
(Artificial Analysis)Math 500(OpenAI (2024), subset of Hendrycks et al. MATH (2021))77.8
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))71.6
Gpqa(NYU + Cohere + Anthropic (2023))51.6
Livecodebench(UC Berkeley + MIT + Cornell (2024))29.1
Aime(MAA (Mathematical Association of America))13.3
Intelligence Index(Artificial Analysis)7.2
Hle(Center for AI Safety + Scale AI (2025))3.3
Scores par catégorie LLM Stats
(LLM Stats (zeroeval))Aucune donnée de score par catégorie disponible
Tarification
Prix d'entréeGratuit
Prix de sortieGratuit
Prix mixte (3:1)Gratuit
Vitesse
Tokens/sec0.0
Délai du premier token0.00s
Temps de réponse0.00s
Classement des Prix par Fournisseur
Aucune donnée de fournisseur disponible