Qwen3 Max Thinking
AlibabaQwenProprietary
説明
The latest flagship reasoning model in the Qwen3 family. Further enhanced by multiple innovations like adaptive tool-use and advanced test-time scaling techniques
リリース日
2026-01-26
パラメータ
1.0T
コンテキスト長
262K
モダリティ
text
能力レーダー
23
general
50
coding
86
reasoning
68
science
40
agents
0
multimodal
ランキング
| ドメイン | #順位 | スコア | ソース |
|---|---|---|---|
| エージェント能力 | 79 | 41.0 | LS |
| コーディングランキング | 236 | 61.0 | AA |
| 総合ランキング | 157 | 59.0 | AA |
| 科学 | 146 | 67.0 | AA |
ベンチマークスコア (LLM Stats)
(LLM Stats (zeroeval))Agents
VITA-Bench
40.9%自己申告
MCP-Mark
33.5%自己申告
DeepPlanning
28.7%自己申告
Toolathlon
18.8%自己申告
Chat
IFEvalGoogle Research (2023)
93.4%自己申告
Multi-Challenge
63.3%自己申告
Code
SecCodeBench
57.5%自己申告
General
C-Eval
93.7%自己申告
MAXIFE
84.0%自己申告
NOVA-63
54.2%自己申告
Instruction Following
IFBench
70.9%自己申告
Knowledge
HLE-Verified
37.6%自己申告
Language
MMLU-Redux
92.8%自己申告
MMLU-Pro
85.7%自己申告
MMMLU
84.4%自己申告
WMT24++
77.6%自己申告
Long Context
LongBench v2
60.6%自己申告
Math
AIME 2026
93.3%自己申告
IMO-AnswerBench
83.9%自己申告
Reasoning
GPQANYU + Cohere + Anthropic (2023)
87.4%自己申告
Global PIQA
86.0%自己申告
LiveCodeBench v6
85.9%自己申告
SWE-Bench Verified
75.3%自己申告
AA-LCR
68.7%自己申告
SuperGPQA
67.3%自己申告
SWE-bench Multilingual
66.7%自己申告
BrowseComp-zh
60.9%自己申告
BrowseCompOpenAI (2025)
53.9%自己申告
Humanity's Last Exam (with tools, text-only)
49.8%自己申告
Seal-0
46.9%自己申告
Humanity's Last Exam (no tools, text-only)
30.2%自己申告
Terminal-Bench 2.0Stanford × Laude Institute (2026)
22.5%自己申告
Search
WideSearch
57.9%自己申告
Tool Calling
BFCL-V4
67.7%自己申告
AA評価指数
(Artificial Analysis)Gpqa(NYU + Cohere + Anthropic (2023))86.1
Tau2(Sierra + U Toronto + Vector Institute (2025))83.6
Lcr(Artificial Analysis)74.3
Ifbench(Google Research (2023))70.7
Hle(Center for AI Safety + Scale AI (2025))28.0
Terminalbench Hard(Stanford × Laude Institute (2026))24.2
Intelligence Index(Artificial Analysis)21.3
LLM Statsカテゴリスコア
(LLM Stats (zeroeval))Language90
Biology90
Chat80
Instruction Following80
Legal80
Physics80
Structured Output80
Finance80
Frontend Development80
Healthcare80
Chemistry80
Math70
Economics70
Long Context60
Reasoning60
General60
Communication60
Search50
Code50
Knowledge40
Agents40
Tool Calling40
価格設定
入力価格無料
出力価格無料
混合価格(3:1)無料
速度
トークン/秒0.0
初トークン遅延0.00s
初回答遅延0.00s
プロバイダー価格ランキング
プロバイダー価格ランキング
1 プロバイダー
プロバイダー入力出力
1DeepInfra
$0
$0.00001
このモデルの異なるAPIプロバイダー間の価格を比較。