Claude Opus 4.6 (Non-reasoning, High Effort)
AnthropicClaudeProprietary
설명
Claude Opus 4.6 is Anthropic's most intelligent model, improving on its predecessor's coding skills with more careful planning, longer agentic task sustenance, more reliable operation in larger codebases, and better code review and debugging skills. First Opus-class model with 1M token context window (beta), 128K output tokens, and adaptive thinking. Features effort controls (low/medium/high/max) and context compaction for long-running tasks. State-of-the-art on Terminal-Bench 2.0, Humanity's Last Exam, GDPval-AA, and BrowseComp. Pricing: $5/$25 per million tokens (input/output).
출시일
2026-02-05
파라미터
—
컨텍스트 길이
1.0M
모달리티
image, text
능력 레이더
41
general
47
coding
84
reasoning
58
science추정
80
agents
80
multimodal
전용 과학 벤치마크가 없을 때 Science는 추론 프록시를 사용하여 추정합니다.
랭킹
| 도메인 | #순위 | 점수 | 소스 |
|---|---|---|---|
| Agents & Tools | 17 | 68.0 | LS |
| Code Ranking | 26 | 80.0 | AA |
| General Ranking | 86 | 71.0 | AA |
| Multimodal Ranking | 37 | 77.0 | LS |
| Reasoning | 46 | 69.0 | LS |
| Science | 58 | 69.0 | AA |
벤치마크 점수 (LLM Stats)
Agents
Vending-Bench 2
801759.0%자체 보고
GDPval-AA
1606.00 / 3000자체 보고
DeepSearchQA
91.3%자체 보고
BrowseComp
84.0%자체 보고
CyberGym
73.8%자체 보고
OSWorld
72.7%자체 보고
Terminal-Bench 2.0
65.4%자체 보고
MCP Atlas
62.7%자체 보고
Finance Agent
60.7%자체 보고
OpenRCA
34.9%자체 보고
Biology
GPQA
91.3%자체 보고
Code
SWE-Bench Verified
80.8%자체 보고
SWE-bench Multilingual
77.8%자체 보고
Communication
Tau2 Telecom
99.3%자체 보고
Tau2 Retail
91.9%자체 보고
General
MRCR v2 (8-needle)
93.0%자체 보고
MMMLU
91.1%자체 보고
MMMU-Pro
77.3%자체 보고
Healthcare
FigQA
78.3%자체 보고
Long Context
Graphwalks parents >128k
95.4%자체 보고
Graphwalks BFS >128k
61.5%자체 보고
Math
AIME 2025
99.8%자체 보고
Humanity's Last Exam
53.1%자체 보고
Multimodal
CharXiv-R
77.4%자체 보고
Reasoning
ARC-AGI v2
68.8%자체 보고
AA 평가 지수
Coding Index47.6
Intelligence Index46.5
Tau20.8
Gpqa0.8
Lcr0.6
Terminalbench Hard0.5
Scicode0.5
Ifbench0.4
Hle0.2
LLM Stats 카테고리 점수
Legal100
Agents100
Finance100
Reasoning100
General100
Communication100
Biology90
Chemistry90
Language90
Physics90
Search90
Spatial Reasoning80
Tool Calling80
Frontend Development80
Healthcare80
Long Context80
Math80
Multimodal80
Safety80
Vision70
Code70
가격
입력 가격$6.25 / 1M tokens
출력 가격$25 / 1M tokens
혼합 가격 (3:1)$10.938 / 1M tokens
속도
토큰/초49.0 tokens/s
첫 토큰 지연1.44s
첫 응답 지연1.44s
사용 가능한 프로바이더
(LS 내부 단위)| 프로바이더 | 입력 가격 | 출력 가격 |
|---|---|---|
| Anthropic | 5.0M | 25.0M |