跳轉到主要內容
AITier
首頁
排行榜
模型
供應商
小工具
自測
繁
搜尋模型 / 榜單 / 場景
AI 模型排行榜
瀏覽和比較 AI 模型,檢視各領域的詳細排名
返回首頁
通用能力榜
程式碼能力榜
數學推理
科學能力
推理能力
智慧體能力模型榜
多模態榜
圖像生成
文字生影片
圖生影片
音訊能力
排名
模型名稱
得分
排名
模型名稱
得分
1
GPT-5.6 Sol (low)
92.0
2
Claude Opus 5 (Adaptive Reasoning, Max Effort)
91.0
3
GPT-5.6 Terra (medium)
91.0
4
Grok 4.6 (high)
91.0
5
Kimi K3 (low)
91.0
6
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
90.0
7
GPT-5.5 (medium)
90.0
8
Muse Spark 1.2 (xhigh)
90.0
9
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
89.0
10
Claude Sonnet 5 (Non-reasoning, High Effort)
89.0
11
GPT-5.4 (xhigh)
88.0
12
Muse Spark 1.1 (xhigh)
88.0
13
Qwen3.8 Max
Open
88.0
14
Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
87.0
15
Grok 4.5 (high)
87.0
16
GPT-5.6 Luna (medium)
86.0
17
Gemini 3.6 Flash (high)
85.0
18
Gemini 3.1 Pro Preview
84.0
19
DeepSeek V4 Pro 0813 (Reasoning, Max Effort)
Open
83.0
20
GPT-5.2 (Non-reasoning)
83.0
35 條記錄
1
2
20 / page
資料來源: LiveBench (Abacus.AI, NYU, NVIDIA, UMD, USC, Columbia) · Reasoning (category) (發布 2026-06-25)
· 資料更新時間: 2026-08-13