メインコンテンツへスキップ
AITier
ホーム
ランキング
モデル
プロバイダー
ウィジェット
テスト
日
モデル / ランキング / シナリオを検索
AIモデルランキング
複数のドメインにわたる詳細なランキングでAIモデルを閲覧・比較
ホームに戻る
総合ランキング
コーディングランキング
数学的推論
科学
推論
エージェント能力
マルチモーダルランキング
画像生成
テキストから動画
画像から動画
音声
順位
モデル名
スコア
順位
モデル名
スコア
1
GPT-5.6 Sol (low)
92.0
2
Claude Opus 5 (Adaptive Reasoning, Max Effort)
91.0
3
GPT-5.6 Terra (medium)
91.0
4
Grok 4.6 (high)
91.0
5
Kimi K3 (low)
91.0
6
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
90.0
7
GPT-5.5 (medium)
90.0
8
Muse Spark 1.2 (xhigh)
90.0
9
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
89.0
10
Claude Sonnet 5 (Non-reasoning, High Effort)
89.0
11
GPT-5.4 (xhigh)
88.0
12
Muse Spark 1.1 (xhigh)
88.0
13
Qwen3.8 Max
Open
88.0
14
Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
87.0
15
Grok 4.5 (high)
87.0
16
GPT-5.6 Luna (medium)
86.0
17
Gemini 3.6 Flash (high)
85.0
18
Gemini 3.1 Pro Preview
84.0
19
DeepSeek V4 Pro 0813 (Reasoning, Max Effort)
Open
83.0
20
GPT-5.2 (Non-reasoning)
83.0
35 件
1
2
20 / page
データソース: LiveBench (Abacus.AI, NYU, NVIDIA, UMD, USC, Columbia) · Reasoning (category) (リリース 2026-06-25)
· 更新日: 2026-08-13