Qwen3.6 Plus
AlibabaQwenProprietary
설명
Qwen3.6 Plus is Alibaba's next-generation flagship model featuring a 1 million token native context window, up to 65,536 output tokens, and always-on chain-of-thought reasoning. It uses a next-generation hybrid architecture optimized for efficiency and scalability. It leads on Terminal-Bench 2.0 agentic coding (61.6), surpassing Claude 4.5 Opus, and achieves strong results on document understanding (OmniDocBench 91.2) and multimodal reasoning (MMMU 86.0). Compared to Qwen 3.5, it is significantly more decisive in reasoning, using fewer tokens on straightforward tasks with better agent stability.
출시일
2026-04-02
파라미터
—
컨텍스트 길이
1.0M
모달리티
image, text, video
능력 레이더
27
general
55
coding
88
reasoning
70
science
60
agents
90
multimodal
랭킹
벤치마크 점수 (LLM Stats)
(LLM Stats (zeroeval))Agents
TAU3-Bench
70.7%자체 보고
MCP-Mark
48.2%자체 보고
VITA-Bench
44.3%자체 보고
DeepPlanning
41.5%자체 보고
Finance Agent v2
40.8%
Toolathlon
39.8%자체 보고
Chat
IFEvalGoogle Research (2023)
94.3%자체 보고
Code
Claw-Eval
58.7%자체 보고
SkillsBench
45.7%자체 보고
NL2Repo
37.9%자체 보고
FrontierSWE
22.0%
General
C-Eval
93.3%자체 보고
MAXIFE
88.2%자체 보고
Include
85.1%자체 보고
NOVA-63
57.9%자체 보고
Instruction Following
IFBench
74.2%자체 보고
Language
MMLU-Redux
94.5%자체 보고
MMMLU
89.5%자체 보고
MMLU-Pro
88.5%자체 보고
MMLU-ProX
84.7%자체 보고
WMT24++
84.3%자체 보고
Long Context
LongBench v2
62.0%자체 보고
Math
HMMT 2025
96.7%자체 보고
AIME 2026
95.3%자체 보고
HMMT25
94.6%자체 보고
We-Math
89.0%자체 보고
DynaMath
88.0%자체 보고
MathVision
88.0%자체 보고
HMMT Feb 26
87.8%자체 보고
IMO-AnswerBench
83.8%자체 보고
PolyMATH
77.4%자체 보고
LiveBench
70.9%
Multimodal
MMMU
86.0%자체 보고
Video-MME
84.2%자체 보고
VideoMMMU
84.0%자체 보고
OSWorld-Verified
62.5%자체 보고
TIR-Bench
61.6%자체 보고
Reasoning
GPQANYU + Cohere + Anthropic (2023)
90.4%자체 보고
Global PIQA
89.8%자체 보고
LiveCodeBench v6
87.1%자체 보고
CharXiv-R
81.5%자체 보고
SWE-Bench Verified
78.8%자체 보고
MCP Atlas
74.1%자체 보고
SWE-bench Multilingual
73.8%자체 보고
SuperGPQA
71.6%자체 보고
AA-LCR
68.3%자체 보고
Terminal-Bench 2.0Stanford × Laude Institute (2026)
61.6%자체 보고
SWE-Bench ProPrinceton NLP (2024)
56.6%자체 보고
Humanity's Last Exam
28.8%자체 보고
Search
WideSearch
74.3%자체 보고
Video
MLVU
86.7%자체 보고
Vision
CountBench
0.98 / 100자체 보고
V*
96.9%자체 보고
AI2D
94.4%자체 보고
RefCOCO-avg
0.94 / 100자체 보고
OmniDocBench 1.5
91.2%자체 보고
RealWorldQA
85.4%자체 보고
CC-OCR
83.4%자체 보고
MMStar
83.3%자체 보고
MMMU-Pro
78.8%자체 보고
ScreenSpot Pro
68.2%자체 보고
SimpleVQA
0.67 / 100자체 보고
ERQA
65.7%자체 보고
MMLongBench-Doc
0.62 / 100자체 보고
ODinW
51.8%자체 보고
AA 평가 지수
(Artificial Analysis)Tau2(Sierra + U Toronto + Vector Institute (2025))97.7
Gpqa(NYU + Cohere + Anthropic (2023))88.2
Lcr(Artificial Analysis)78.3
Ifbench(Google Research (2023))75.2
Terminalbench V2 161.4
Coding Index(Artificial Analysis)54.5
Terminalbench Hard(Stanford × Laude Institute (2026))43.9
Hle(Center for AI Safety + Scale AI (2025))27.8
Intelligence Index(Artificial Analysis)27.0
Tau Banking20.8
LLM Stats 카테고리 점수
(LLM Stats (zeroeval))Chat90
Language90
Biology90
Video90
Instruction Following80
Legal80
Math80
Multimodal80
Physics80
Reasoning80
Spatial Reasoning80
Structured Output80
Frontend Development80
Grounding80
Healthcare80
Chemistry80
Text-to-image80
Vision80
Image To Text70
Long Context70
Search70
Finance70
General70
Economics70
Code60
Tool Calling60
Agents50
가격
입력 가격$0.5 / 1M 토큰
출력 가격$3 / 1M 토큰
혼합 가격 (3:1)$1.125 / 1M 토큰
캐시 읽기 가격$0.05 / 1M 토큰
캐시 쓰기 가격$0.625 / 1M 토큰
속도
토큰/초0.0
첫 토큰 지연0.00s
첫 응답 지연0.00s
공급자 가격 순위
공급자 가격 순위
21개 공급자
최저가: Together최고가: Ofox
공급자입력출력
1Together최저가
$0
$0
2Novita
$0
$0
3Merge Gateway
$0.276
$1.651
4AIHubMix
$0.28
$1.69
5302.AI
$0.3
$1.8
6CrossModel
$0.32
$1.88
7NanoGPT
$0.325
$1.95
8OpenRouter
$0.325
$1.95
9Kilo Gateway
$0.325
$1.95
10Pioneer
$0.325
$1.95
11Alibaba주요
$0.5
$3
12OpenCode Go
$0.5
$3
13Alibaba (China)
$0.5
$3
14ZenMux
$0.5
$3
15OpenCode Zen
$0.5
$3
16Requesty
$0.5
$3
17DevPass (LLM Gateway)
$0.5
$3
18OrcaRouter
$0.5
$3
19LLMTR
$0.5
$3
20EmpirioLabs AI
$0.5
$3
21Ofox
$0.5
$3
이 모델의 다양한 API 공급자 간 가격 비교.