Qwen3.5 27B (Reasoning)
AlibabaQwen开源权重Apache 2.0 · 商用许可
描述
Qwen3.5-27B is a multimodal dense foundation model with 27 billion parameters. It combines strong reasoning, coding, multilingual, long-context, and visual understanding performance in a production-friendly open-weight package with a native 262K context window.
发布日期
2026-02-24
参数规模
27.0B
上下文长度
262K
支持模态
audio, image, text, video
能力雷达图
32
general
40
coding
86
reasoning
57
science
60
agents
80
multimodal
排行榜排名
基准测试分数 (LLM Stats)
(LLM Stats (zeroeval))3d
SUNRGBD
0.35 / 100自报
Hypersim
0.13 / 100自报
Agents
t2-bench
79.0%自报
BFCL-V4
68.5%自报
AndroidWorld_SR
64.2%自报
WideSearch
61.1%自报
BrowseCompOpenAI (2025)
61.0%自报
FullStackBench en
60.1%自报
TIR-Bench
59.8%自报
FullStackBench zh
57.4%自报
OSWorld-Verified
56.2%自报
VITA-Bench
41.9%自报
Terminal-Bench 2.0Stanford × Laude Institute (2026)
41.6%自报
DeepPlanning
22.6%自报
Biology
GPQANYU + Cohere + Anthropic (2023)
85.5%自报
Chemistry
SuperGPQA
65.6%自报
Code
SWE-Bench Verified
72.4%自报
Communication
Multi-Challenge
60.8%自报
Embodied
EmbSpatialBench
0.84 / 100自报
Finance
MMLU-Pro
86.1%自报
MMLU-ProX
82.2%自报
General
IFEvalGoogle Research (2023)
95.0%自报
MMLU-Redux
93.2%自报
C-Eval
90.5%自报
MAXIFE
88.0%自报
Global PIQA
87.5%自报
MMMLU
85.9%自报
MMMU
82.3%自报
Include
81.6%自报
MMStar
81.0%自报
LiveCodeBench v6
80.7%自报
IFBench
76.5%自报
MMMU-Pro
75.0%自报
LongBench v2
60.6%自报
NOVA-63
58.1%自报
SimpleVQA
0.56 / 100自报
Grounding
RefCOCO-avg
0.91 / 100自报
ScreenSpot Pro
70.3%自报
RefSpatialBench
0.68 / 100自报
Healthcare
VideoMMMU
82.3%自报
SlakeVQA
80.0%自报
MedXpertQA
62.4%自报
PMC-VQA
62.4%自报
Image To Text
OCRBench
89.4%自报
Language
LingoQA
82.0%自报
WMT24++
77.6%自报
Long Context
MLVU
85.9%自报
LVBench
73.6%自报
AA-LCR
66.1%自报
MMLongBench-Doc
0.60 / 100自报
Math
HMMT 2025
92.0%自报
HMMT25
89.8%自报
MathVista-Mini
87.8%自报
DynaMath
87.7%自报
MathVision
86.0%自报
CodeForces
0.81 / 3000自报
PolyMATH
71.2%自报
Humanity's Last Exam
48.5%自报
Multimodal
VLMsAreBlind
96.9%自报
V*
93.7%自报
AI2D
92.9%自报
MMBench-V1.1
92.6%自报
OmniDocBench 1.5
88.9%自报
VideoMME w sub.
87.0%自报
VideoMME w/o sub.
82.8%自报
CC-OCR
81.0%自报
CharXiv-R
79.5%自报
MVBench
74.6%自报
MMVU
73.3%自报
BabyVision
44.6%自报
ZEROBench-Sub
0.36 / 100自报
Nuscene
15.2%自报
ZEROBench
0.10 / 100自报
Reasoning
CountBench
0.98 / 100自报
Hallusion Bench
70.0%自报
BrowseComp-zh
62.1%自报
ERQA
60.5%自报
Seal-0
47.2%自报
OJBench
40.1%自报
Spatial Reasoning
RealWorldQA
83.7%自报
Vision
ODinW
41.1%自报
AA 评测指数
(Artificial Analysis)Intelligence Index(Artificial Analysis)34.6
Tau2(Sierra + U Toronto + Vector Institute (2025))0.9
Gpqa(NYU + Cohere + Anthropic (2023))0.9
Ifbench(Google Research (2023))0.8
Lcr(Artificial Analysis)0.7
Scicode(UIUC + Argonne National Lab (2024))0.4
Terminalbench Hard(Stanford × Laude Institute (2026))0.3
Hle(Center for AI Safety + Scale AI (2025))0.2
LLM Stats 分类评分
(LLM Stats (zeroeval))Instruction Following90
Biology90
Legal80
Math80
Physics80
Structured Output80
Image To Text80
Language80
Embodied80
Finance80
Grounding80
Chemistry80
Text-to-image80
Video80
Long Context70
Multimodal70
Reasoning70
Spatial Reasoning70
Frontend Development70
General70
Healthcare70
Economics70
Vision70
Search60
Agents60
Code60
Communication60
Tool Calling60
Spatial20
3d20
定价
输入价格$0.3 / 1M tokens
输出价格$2.4 / 1M tokens
混合价格(3:1)$0.825 / 1M tokens
速度
Tokens/秒0.0
首Token延迟0.00s
首回答延迟0.00s
供应商价格排行
供应商价格排行
4 个供应商
最便宜: Novita最贵: Alibaba
供应商输入输出
1Novita最便宜
$0
$0
2EmpirioLabs AI
$0.086
$0.688
3NanoGPT
$0.27
$2.16
4Alibaba主要
$0.3
$2.4
比较该模型在不同 API 供应商之间的定价。