跳轉到主要內容
AITier
首頁
排行榜
模型
供應商
小工具
自測
繁
搜尋模型 / 榜單 / 場景
AI 模型排行榜
瀏覽和比較 AI 模型,檢視各領域的詳細排名
返回首頁
通用能力榜
程式碼能力榜
數學推理
科學能力
推理能力
智慧體能力模型榜
多模態榜
圖像生成
文字生影片
圖生影片
音訊能力
排名
模型名稱
得分
排名
模型名稱
得分
2
GPT-6 Astra (low)
93.0
1
GPT-6.1 Sol (low)
93.0
4
Claude Opus 5.5 (Adaptive Reasoning, Low Effort, Default Fallback)
92.0
5
Claude Sonnet 5.5 (Adaptive Reasoning, Low Effort, Default Fallback)
92.0
6
GPT-5.6 Sol (Non-reasoning)
92.0
7
GPT-6.1 Sol (low)
92.0
3
Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback)
92.0
8
Claude Opus 5.5 (Adaptive Reasoning, Low Effort, Default Fallback)
91.0
9
Claude Opus 5 (Adaptive Reasoning, Low Effort)
91.0
10
GPT-5.6 Terra (Non-reasoning)
91.0
11
Grok 4.6 (low)
91.0
12
Kimi K3 (low)
91.0
15
Muse Spark 1.2 (xhigh)
90.0
16
Muse Spark 1.3 (xhigh)
90.0
14
GPT-5.5 (Non-reasoning)
90.0
13
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
90.0
17
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
89.0
18
Claude Sonnet 5 (Non-reasoning, High Effort)
89.0
19
Gemini 3.8 Flash (low)
89.0
20
GPT-6 Sol (Non-reasoning)
89.0
55 條記錄
1
2
3
20 / page
資料來源: LiveBench (Abacus.AI, NYU, NVIDIA, UMD, USC, Columbia) · Reasoning (category) (發布 2026-06-25)
· 資料更新時間: 2026-09-30