Passer au contenu principal

Claude 3 Sonnet

AnthropicClaudeProprietary

Description

Claude 3 Sonnet strikes the ideal balance between intelligence and speed—particularly for enterprise workloads. It delivers strong performance at a lower cost compared to its peers, and is engineered for high endurance in large-scale AI deployments.

Date de sortie
2024-03-04
Paramètres
—
Longueur du contexte
—
Modalités
image, text

Radar de capacités

21
general
18
coding
23
reasoning
29
science
21
agents
80
multimodal

Classements

Domaine#RangScoreSource
Classement codage523
19.0
AA
Classement général545
24.0
AA
Science576
20.0
AA

Scores de benchmarks (LLM Stats)

(LLM Stats (zeroeval))

General

MMLU79.0%Aut.

Language

MMLU-Pro56.8%Aut.

Math

GSM8k92.3%Aut.
MGSM83.5%Aut.
MATH43.1%Aut.

Reasoning

ARC-C93.2%Aut.
HellaSwagAI2 (2019)89.0%Aut.
BIG-Bench Hard82.9%Aut.
DROP78.9%Aut.
HumanEvalOpenAI (2021)73.0%Aut.
GPQANYU + Cohere + Anthropic (2023)40.4%Aut.

Indices d'évaluation AA

(Artificial Analysis)
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
57.9
Math 500(OpenAI (2024), subset of Hendrycks et al. MATH (2021))
41.4
Gpqa(NYU + Cohere + Anthropic (2023))
40.0
Livecodebench(UC Berkeley + MIT + Cornell (2024))
17.5
Intelligence Index(Artificial Analysis)
5.9
Aime(MAA (Mathematical Association of America))
4.7
Hle(Center for AI Safety + Scale AI (2025))
3.6

Scores par catégorie LLM Stats

(LLM Stats (zeroeval))
Language
70
Legal
70
Math
70
Reasoning
70
Finance
70
General
70
Healthcare
70
Code
70
Physics
40
Biology
40
Chemistry
40

Tarification

Prix d'entréeGratuit
Prix de sortieGratuit
Prix mixte (3:1)Gratuit

Vitesse

Tokens/sec0.0
Délai du premier token0.00s
Temps de réponse0.00s

Classement des Prix par Fournisseur

Aucune donnée de fournisseur disponible

Sources externes