Claude 3 Opus
AnthropicClaudeProprietary
Описание
Claude 3 Opus is Anthropic's most intelligent model, with best-in-market performance on highly complex tasks. It can navigate open-ended prompts and sight-unseen scenarios with remarkable fluency and human-like understanding, showing the outer limits of what's possible with generative AI.
Дата выхода
2024-03-04
Параметры
—
Длина контекста
—
Модальности
image, text
Радар способностей
26
general
23
coding
31
reasoning
35
science
29
agents
80
multimodal
Рейтинги
| Домен | #Место | Оценка | Источник |
|---|---|---|---|
| Рейтинг кодинга | 460 | 26.0 | AA |
| Общий рейтинг | 435 | 32.0 | AA |
| Наука | 530 | 24.0 | AA |
Оценки бенчмарков (LLM Stats)
(LLM Stats (zeroeval))General
MMLU
86.8%Сам.
Language
MMLU-Pro
68.5%Сам.
Math
GSM8k
95.0%Сам.
MGSM
90.7%Сам.
MATH
60.1%Сам.
Reasoning
ARC-C
96.4%Сам.
HellaSwagAI2 (2019)
95.4%Сам.
BIG-Bench Hard
86.8%Сам.
HumanEvalOpenAI (2021)
84.9%Сам.
DROP
83.1%Сам.
GPQANYU + Cohere + Anthropic (2023)
50.4%Сам.
Индексы оценки AA
(Artificial Analysis)Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))69.6
Math 500(OpenAI (2024), subset of Hendrycks et al. MATH (2021))64.1
Gpqa(NYU + Cohere + Anthropic (2023))48.9
Livecodebench(UC Berkeley + MIT + Cornell (2024))27.9
Coding Index(Artificial Analysis)19.5
Intelligence Index(Artificial Analysis)8.7
Aime(MAA (Mathematical Association of America))3.3
Hle(Center for AI Safety + Scale AI (2025))2.8
Оценки категорий LLM Stats
(LLM Stats (zeroeval))Language80
Legal80
Math80
Reasoning80
Finance80
General80
Healthcare80
Code80
Physics50
Biology50
Chemistry50
Цены
Цена ввода$15 / 1M токенов
Цена вывода$75 / 1M токенов
Смешанная цена (3:1)$30 / 1M токенов
Скорость
Токенов/сек0.0
Задержка первого токена0.00s
Время до первого ответа0.00s
Рейтинг цен провайдеров
Рейтинг цен провайдеров
1 провайдеров
ПровайдерВводВывод
1AnthropicОсновной
$15
$75
Сравнение цен разных API-провайдеров для этой модели.