메인 콘텐츠로 건너뛰기
AITier
홈
랭킹
모델
공급자
위젯
테스트
한
모델 / 랭킹 / 시나리오 검색
AI 모델 랭킹
여러 도메인의 상세한 랭킹으로 AI 모델을 탐색하고 비교하세요
홈으로 돌아가기
종합 랭킹
코딩 랭킹
수학 추론
과학
추론
에이전트형 역량
멀티모달 랭킹
이미지 생성
텍스트-투-비디오
이미지-투-비디오
오디오
순위
모델명
점수
순위
모델명
점수
1
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
96.0
2
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
96.0
3
GPT-5.5 (Non-reasoning)
96.0
4
GPT-5.6 Sol (xhigh)
96.0
5
GPT-5.6 Terra (low)
95.0
6
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
94.0
7
GPT-5.4 (xhigh)
94.0
8
Claude Opus 4.7 (Non-reasoning, High Effort)
93.0
9
Claude Sonnet 5 (Adaptive Reasoning, Low Effort)
93.0
10
GPT-5.2 (Non-reasoning)
93.0
11
Grok 4.6 (high)
93.0
12
DeepSeek V4 Pro 0813 (Reasoning, Max Effort)
Open
91.0
13
Gemini 3.1 Pro Preview
91.0
14
GPT-5.4 nano (medium)
91.0
15
Grok 4.5 (high)
91.0
16
Muse Spark 1.2 (xhigh)
91.0
17
Qwen3.8 Max
91.0
18
GLM-5.2
Open
90.0
19
GPT-5.2 Codex (xhigh)
89.0
20
Gemini 3.5 Flash (high)
88.0
35개 항목
1
2
20 / page
데이터 출처: LiveBench (Abacus.AI, NYU, NVIDIA, UMD, USC, Columbia) · Mathematics (category) (릴리즈 2026-06-25)
· 업데이트: 2026-08-13