Claude Opus 4.6 (Non-reasoning, High Effort)
AnthropicClaudeProprietary
Описание
Claude Opus 4.6 is Anthropic's most intelligent model, improving on its predecessor's coding skills with more careful planning, longer agentic task sustenance, more reliable operation in larger codebases, and better code review and debugging skills. First Opus-class model with 1M token context window (beta), 128K output tokens, and adaptive thinking. Features effort controls (low/medium/high/max) and context compaction for long-running tasks. State-of-the-art on Terminal-Bench 2.0, Humanity's Last Exam, GDPval-AA, and BrowseComp. Pricing: $5/$25 per million tokens (input/output).
Дата выхода
2026-02-05
Параметры
—
Длина контекста
1.0M
Модальности
image, pdf, text
Радар способностей
35
general
46
coding
84
reasoning
58
science
80
agents
80
multimodal
Рейтинги
| Домен | #Место | Оценка | Источник |
|---|---|---|---|
| Агентные возможности | 25 | 57.0 | LS |
| Рейтинг кодинга | 83 | 75.0 | AA |
| Общий рейтинг | 139 | 64.0 | AA |
| Мультимодальный рейтинг | 46 | 46.0 | LS |
| Наука | 125 | 65.0 | AA |
Оценки бенчмарков (LLM Stats)
(LLM Stats (zeroeval))Agents
Vending-Bench 2
801759.0%Сам.
DeepSearchQA
91.3%Сам.
BrowseCompOpenAI (2025)
84.0%Сам.
CyberGym
73.8%Сам.
OSWorld
72.7%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)
65.4%Сам.
MCP Atlas
62.7%Сам.
Finance Agent
60.7%Сам.
FrontierSWE
56.0%
OpenRCA
34.9%Сам.
Legal Agent Benchmark
4.2%
Biology
GPQANYU + Cohere + Anthropic (2023)
91.3%Сам.
Code
SWE-Bench Verified
80.8%Сам.
SWE-bench Multilingual
77.8%Сам.
Communication
Tau2 Telecom
99.3%Сам.
Tau2 Retail
91.9%Сам.
General
MMMLU
91.1%Сам.
MMMU-Pro
77.3%Сам.
LiveBench
76.3%
MRCR v2 (8-needle)
76.0%Сам.
Healthcare
FigQA
78.3%Сам.
Long Context
Graphwalks parents >128k
95.4%Сам.
Graphwalks BFS >128k
61.5%Сам.
Math
AIME 2025
99.8%Сам.
Humanity's Last Exam
53.1%Сам.
Multimodal
CharXiv-R
77.4%Сам.
Reasoning
ARC-AGI v2
68.8%Сам.
Индексы оценки AA
(Artificial Analysis)Intelligence Index(Artificial Analysis)38.8
Tau2(Sierra + U Toronto + Vector Institute (2025))0.8
Gpqa(NYU + Cohere + Anthropic (2023))0.8
Lcr(Artificial Analysis)0.6
Terminalbench Hard(Stanford × Laude Institute (2026))0.5
Scicode(UIUC + Argonne National Lab (2024))0.5
Ifbench(Google Research (2023))0.4
Hle(Center for AI Safety + Scale AI (2025))0.2
Оценки категорий LLM Stats
(LLM Stats (zeroeval))Agents100
Reasoning100
General100
Communication100
Physics90
Search90
Language90
Biology90
Chemistry90
Long Context80
Math80
Multimodal80
Safety80
Spatial Reasoning80
Frontend Development80
Healthcare80
Tool Calling80
Code70
Vision70
Finance60
Legal0
Цены
Цена ввода$5 / 1M токенов
Цена вывода$25 / 1M токенов
Смешанная цена (3:1)$10 / 1M токенов
Цена чтения кэша$0.5 / 1M токенов
Цена записи кэша$6.25 / 1M токенов
Скорость
Токенов/сек0.0
Задержка первого токена0.00s
Время до первого ответа0.00s
Рейтинг цен провайдеров
Рейтинг цен провайдеров
1 провайдеров
ПровайдерВводВывод
1Anthropic
$0.00001
$0.00003
Сравнение цен разных API-провайдеров для этой модели.