Qwen3.5 27B (Reasoning)
AlibabaQwen오픈 웨이트Apache 2.0 · 상업적 사용 가능
설명
Qwen3.5-27B is a multimodal dense foundation model with 27 billion parameters. It combines strong reasoning, coding, multilingual, long-context, and visual understanding performance in a production-friendly open-weight package with a native 262K context window.
출시일
2026-02-24
파라미터
27.0B
컨텍스트 길이
262K
모달리티
audio, image, text, video
능력 레이더
23
general
60
coding
86
reasoning
67
science
60
agents
80
multimodal
랭킹
벤치마크 점수 (LLM Stats)
(LLM Stats (zeroeval))Agents
t2-bench
79.0%자체 보고
VITA-Bench
41.9%자체 보고
DeepPlanning
22.6%자체 보고
Chat
IFEvalGoogle Research (2023)
95.0%자체 보고
Multi-Challenge
60.8%자체 보고
Code
FullStackBench en
60.1%자체 보고
FullStackBench zh
57.4%자체 보고
General
C-Eval
90.5%자체 보고
MAXIFE
88.0%자체 보고
Include
81.6%자체 보고
AndroidWorld_SR
64.2%자체 보고
NOVA-63
58.1%자체 보고
Healthcare
MedXpertQA
62.4%자체 보고
PMC-VQA
62.4%자체 보고
Instruction Following
IFBench
76.5%자체 보고
Language
MMLU-Redux
93.2%자체 보고
MMLU-Pro
86.1%자체 보고
MMMLU
85.9%자체 보고
MMLU-ProX
82.2%자체 보고
WMT24++
77.6%자체 보고
Long Context
LongBench v2
60.6%자체 보고
Math
HMMT 2025
92.0%자체 보고
HMMT25
89.8%자체 보고
MathVista-Mini
87.8%자체 보고
DynaMath
87.7%자체 보고
MathVision
86.0%자체 보고
CodeForces
0.81 / 3000자체 보고
PolyMATH
71.2%자체 보고
Multimodal
VideoMME w/o sub.
82.8%자체 보고
VideoMMMU
82.3%자체 보고
MMMU
82.3%자체 보고
TIR-Bench
59.8%자체 보고
OSWorld-Verified
56.2%자체 보고
Reasoning
Global PIQA
87.5%자체 보고
GPQANYU + Cohere + Anthropic (2023)
85.5%자체 보고
LiveCodeBench v6
80.7%자체 보고
CharXiv-R
79.5%자체 보고
SWE-Bench Verified
72.4%자체 보고
AA-LCR
66.1%자체 보고
SuperGPQA
65.6%자체 보고
BrowseComp-zh
62.1%자체 보고
BrowseCompOpenAI (2025)
61.0%자체 보고
Humanity's Last Exam
48.5%자체 보고
Seal-0
47.2%자체 보고
Terminal-Bench 2.0Stanford × Laude Institute (2026)
41.6%자체 보고
OJBench
40.1%자체 보고
Search
WideSearch
61.1%자체 보고
Tool Calling
BFCL-V4
68.5%자체 보고
Video
MLVU
85.9%자체 보고
Vision
CountBench
0.98 / 100자체 보고
VLMsAreBlind
96.9%자체 보고
V*
93.7%자체 보고
AI2D
92.9%자체 보고
MMBench-V1.1
92.6%자체 보고
RefCOCO-avg
0.91 / 100자체 보고
OCRBench
89.4%자체 보고
OmniDocBench 1.5
88.9%자체 보고
VideoMME w sub.
87.0%자체 보고
EmbSpatialBench
0.84 / 100자체 보고
RealWorldQA
83.7%자체 보고
LingoQA
82.0%자체 보고
CC-OCR
81.0%자체 보고
MMStar
81.0%자체 보고
SlakeVQA
80.0%자체 보고
MMMU-Pro
75.0%자체 보고
MVBench
74.6%자체 보고
LVBench
73.6%자체 보고
MMVU
73.3%자체 보고
ScreenSpot Pro
70.3%자체 보고
Hallusion Bench
70.0%자체 보고
RefSpatialBench
0.68 / 100자체 보고
ERQA
60.5%자체 보고
MMLongBench-Doc
0.60 / 100자체 보고
SimpleVQA
0.56 / 100자체 보고
BabyVision
44.6%자체 보고
ODinW
41.1%자체 보고
ZEROBench-Sub
0.36 / 100자체 보고
SUNRGBD
0.35 / 100자체 보고
Nuscene
15.2%자체 보고
Hypersim
0.13 / 100자체 보고
ZEROBench
0.10 / 100자체 보고
AA 평가 지수
(Artificial Analysis)Tau2(Sierra + U Toronto + Vector Institute (2025))93.9
Gpqa(NYU + Cohere + Anthropic (2023))85.8
Lcr(Artificial Analysis)77.7
Ifbench(Google Research (2023))75.6
Terminalbench Hard(Stanford × Laude Institute (2026))32.6
Hle(Center for AI Safety + Scale AI (2025))23.9
Intelligence Index(Artificial Analysis)22.9
LLM Stats 카테고리 점수
(LLM Stats (zeroeval))Instruction Following90
Biology90
Chat80
Image To Text80
Language80
Legal80
Math80
Physics80
Structured Output80
Embodied80
Finance80
Grounding80
Chemistry80
Text-to-image80
Video80
Long Context70
Multimodal70
Reasoning70
Spatial Reasoning70
Frontend Development70
General70
Healthcare70
Economics70
Vision70
Search60
Agents60
Code60
Communication60
Tool Calling60
Spatial20
3d20
가격
입력 가격$0.3 / 1M 토큰
출력 가격$2.4 / 1M 토큰
혼합 가격 (3:1)$0.825 / 1M 토큰
속도
토큰/초0.0
첫 토큰 지연0.00s
첫 응답 지연0.00s
공급자 가격 순위
공급자 가격 순위
4개 공급자
최저가: DeepInfra최고가: Alibaba
공급자입력출력
1DeepInfra최저가
$0
$0
2Novita
$0
$0
3EmpirioLabs AI
$0.086
$0.688
4Alibaba주요
$0.3
$2.4
이 모델의 다양한 API 공급자 간 가격 비교.