Qwen3.6 Plus
AlibabaQwenProprietary
描述
Qwen3.6 Plus is Alibaba's next-generation flagship model featuring a 1 million token native context window, up to 65,536 output tokens, and always-on chain-of-thought reasoning. It uses a next-generation hybrid architecture optimized for efficiency and scalability. It leads on Terminal-Bench 2.0 agentic coding (61.6), surpassing Claude 4.5 Opus, and achieves strong results on document understanding (OmniDocBench 91.2) and multimodal reasoning (MMMU 86.0). Compared to Qwen 3.5, it is significantly more decisive in reasoning, using fewer tokens on straightforward tasks with better agent stability.
發布日期
2026-04-02
參數規模
—
上下文長度
1.0M
支援模態
image, text, video
能力雷達圖
38
general
52
coding
88
reasoning
59
science
60
agents
90
multimodal
排行榜排名
基準測試分數 (LLM Stats)
(LLM Stats (zeroeval))Agents
WideSearch
74.3%自報
MCP Atlas
74.1%自報
TAU3-Bench
70.7%自報
OSWorld-Verified
62.5%自報
TIR-Bench
61.6%自報
Terminal-Bench 2.0Stanford × Laude Institute (2026)
61.6%自報
Claw-Eval
58.7%自報
SWE-Bench ProPrinceton NLP (2024)
56.6%自報
MCP-Mark
48.2%自報
SkillsBench
45.7%自報
VITA-Bench
44.3%自報
DeepPlanning
41.5%自報
Finance Agent v2
40.8%
Toolathlon
39.8%自報
NL2Repo
37.9%自報
FrontierSWE
22.0%
Biology
GPQANYU + Cohere + Anthropic (2023)
90.4%自報
Chemistry
SuperGPQA
71.6%自報
Code
SWE-Bench Verified
78.8%自報
SWE-bench Multilingual
73.8%自報
Finance
MMLU-Pro
88.5%自報
MMLU-ProX
84.7%自報
General
MMLU-Redux
94.5%自報
IFEvalGoogle Research (2023)
94.3%自報
C-Eval
93.3%自報
Global PIQA
89.8%自報
MMMLU
89.5%自報
MAXIFE
88.2%自報
LiveCodeBench v6
87.1%自報
MMMU
86.0%自報
Include
85.1%自報
MMStar
83.3%自報
MMMU-Pro
78.8%自報
IFBench
74.2%自報
LiveBench
70.9%
SimpleVQA
0.67 / 100自報
LongBench v2
62.0%自報
NOVA-63
57.9%自報
Grounding
RefCOCO-avg
0.94 / 100自報
ScreenSpot Pro
68.2%自報
Healthcare
VideoMMMU
84.0%自報
Language
WMT24++
84.3%自報
Long Context
MLVU
86.7%自報
AA-LCR
68.3%自報
MMLongBench-Doc
0.62 / 100自報
Math
HMMT 2025
96.7%自報
AIME 2026
95.3%自報
HMMT25
94.6%自報
We-Math
89.0%自報
DynaMath
88.0%自報
MathVision
88.0%自報
HMMT Feb 26
87.8%自報
IMO-AnswerBench
83.8%自報
PolyMATH
77.4%自報
Humanity's Last Exam
28.8%自報
Multimodal
V*
96.9%自報
AI2D
94.4%自報
OmniDocBench 1.5
91.2%自報
Video-MME
84.2%自報
CC-OCR
83.4%自報
CharXiv-R
81.5%自報
Reasoning
CountBench
0.98 / 100自報
ERQA
65.7%自報
Spatial Reasoning
RealWorldQA
85.4%自報
Vision
ODinW
51.8%自報
AA 評測指數
(Artificial Analysis)Coding Index(Artificial Analysis)54.5
Intelligence Index(Artificial Analysis)40.5
Tau2(Sierra + U Toronto + Vector Institute (2025))1.0
Gpqa(NYU + Cohere + Anthropic (2023))0.9
Ifbench(Google Research (2023))0.8
Lcr(Artificial Analysis)0.7
Terminalbench V2 10.6
Terminalbench Hard(Stanford × Laude Institute (2026))0.4
Scicode(UIUC + Argonne National Lab (2024))0.4
Hle(Center for AI Safety + Scale AI (2025))0.3
Tau Banking0.2
LLM Stats 分類評分
(LLM Stats (zeroeval))Language90
Biology90
Video90
Legal80
Math80
Multimodal80
Physics80
Reasoning80
Spatial Reasoning80
Structured Output80
Instruction Following80
Frontend Development80
Grounding80
Healthcare80
Chemistry80
Text-to-image80
Vision80
Long Context70
Search70
Image To Text70
Finance70
General70
Economics70
Code60
Tool Calling60
Agents50
定價
輸入價格$0.5 / 1M tokens
輸出價格$3 / 1M tokens
混合價格(3:1)$1.125 / 1M tokens
快取讀取價格$0.05 / 1M tokens
快取寫入價格$0.625 / 1M tokens
速度
Tokens/秒0.0
首Token延遲0.00s
首回答延遲0.00s
供應商價格排行
供應商價格排行
17 個供應商
最便宜: Together最貴: Charm Hyper
供應商輸入輸出
1Together最便宜
$0
$0
2Novita
$0
$0
3Merge Gateway
$0.276
$1.651
4AIHubMix
$0.28
$1.69
5CrossModel
$0.32
$1.88
6OpenRouter
$0.325
$1.95
7Kilo Gateway
$0.325
$1.95
8Pioneer
$0.325
$1.95
9Alibaba主要
$0.5
$3
10OpenCode Go
$0.5
$3
11Alibaba (China)
$0.5
$3
12ZenMux
$0.5
$3
13OpenCode Zen
$0.5
$3
14LLM Gateway
$0.5
$3
15OrcaRouter
$0.5
$3
16EmpirioLabs AI
$0.5
$3
17Charm Hyper
$2
$6
比較該模型在不同 API 供應商之間的定價。