メインコンテンツへスキップ
AITier
ホーム
ランキング
モデル
プロバイダー
ウィジェット
テスト
日
モデル / ランキング / シナリオを検索
AIモデルランキング
複数のドメインにわたる詳細なランキングでAIモデルを閲覧・比較
ホームに戻る
総合ランキング
コーディングランキング
数学的推論
科学
推論
エージェント能力
マルチモーダルランキング
画像生成
テキストから動画
画像から動画
音声
順位
モデル名
スコア
順位
モデル名
スコア
1
GPT-5.6 Sol (Non-reasoning)
92.0
2
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
91.0
3
GPT-5.6 Terra (Non-reasoning)
91.0
4
Kimi K3 (low)
91.0
5
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
90.0
6
GPT-5.5 (low)
90.0
7
Muse Spark 1.2 (xhigh)
90.0
8
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
89.0
9
Claude Sonnet 5 (Adaptive Reasoning, Low Effort)
89.0
10
GPT-5.4 (Non-reasoning)
88.0
11
Muse Spark 1.1 (xhigh)
88.0
12
Qwen3.8 Max
88.0
13
Claude Opus 4.7 (Non-reasoning, High Effort)
87.0
14
Grok 4.5 (high)
87.0
15
GPT-5.6 Luna (max)
86.0
16
Gemini 3.6 Flash (high)
85.0
17
Gemini 3.1 Pro Preview
84.0
18
DeepSeek V4 Pro (Reasoning, Max Effort)
Open
83.0
19
GPT-5.2 (medium)
83.0
20
Kimi K2.7 Code
Open
83.0
34 件
1
2
20 / page
データソース: LiveBench (Abacus.AI, NYU, NVIDIA, UMD, USC, Columbia) · Reasoning (category) (リリース 2026-06-25)
· 更新日: 2026-08-12