Qwen3.5 27B (Reasoning)
AlibabaQwenОткрытые весаApache 2.0 · Коммерческое использование
Описание
Qwen3.5-27B is a multimodal dense foundation model with 27 billion parameters. It combines strong reasoning, coding, multilingual, long-context, and visual understanding performance in a production-friendly open-weight package with a native 262K context window.
Дата выхода
2026-02-24
Параметры
27.0B
Длина контекста
262K
Модальности
audio, image, text, video
Радар способностей
23
general
60
coding
86
reasoning
67
science
60
agents
80
multimodal
Рейтинги
| Домен | #Место | Оценка | Источник |
|---|---|---|---|
| Агентные возможности | 57 | 48.0 | LS |
| Рейтинг кодинга | 183 | 69.0 | AA |
| Общий рейтинг | 117 | 64.0 | AA |
| Мультимодальный рейтинг | 74 | 53.0 | LS |
| Наука | 163 | 63.0 | AA |
Оценки бенчмарков (LLM Stats)
(LLM Stats (zeroeval))Agents
t2-bench
79.0%Сам.
VITA-Bench
41.9%Сам.
DeepPlanning
22.6%Сам.
Chat
IFEvalGoogle Research (2023)
95.0%Сам.
Multi-Challenge
60.8%Сам.
Code
FullStackBench en
60.1%Сам.
FullStackBench zh
57.4%Сам.
General
C-Eval
90.5%Сам.
MAXIFE
88.0%Сам.
Include
81.6%Сам.
AndroidWorld_SR
64.2%Сам.
NOVA-63
58.1%Сам.
Healthcare
MedXpertQA
62.4%Сам.
PMC-VQA
62.4%Сам.
Instruction Following
IFBench
76.5%Сам.
Language
MMLU-Redux
93.2%Сам.
MMLU-Pro
86.1%Сам.
MMMLU
85.9%Сам.
MMLU-ProX
82.2%Сам.
WMT24++
77.6%Сам.
Long Context
LongBench v2
60.6%Сам.
Math
HMMT 2025
92.0%Сам.
HMMT25
89.8%Сам.
MathVista-Mini
87.8%Сам.
DynaMath
87.7%Сам.
MathVision
86.0%Сам.
CodeForces
0.81 / 3000Сам.
PolyMATH
71.2%Сам.
Multimodal
VideoMME w/o sub.
82.8%Сам.
VideoMMMU
82.3%Сам.
MMMU
82.3%Сам.
TIR-Bench
59.8%Сам.
OSWorld-Verified
56.2%Сам.
Reasoning
Global PIQA
87.5%Сам.
GPQANYU + Cohere + Anthropic (2023)
85.5%Сам.
LiveCodeBench v6
80.7%Сам.
CharXiv-R
79.5%Сам.
SWE-Bench Verified
72.4%Сам.
AA-LCR
66.1%Сам.
SuperGPQA
65.6%Сам.
BrowseComp-zh
62.1%Сам.
BrowseCompOpenAI (2025)
61.0%Сам.
Humanity's Last Exam
48.5%Сам.
Seal-0
47.2%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)
41.6%Сам.
OJBench
40.1%Сам.
Search
WideSearch
61.1%Сам.
Tool Calling
BFCL-V4
68.5%Сам.
Video
MLVU
85.9%Сам.
Vision
CountBench
0.98 / 100Сам.
VLMsAreBlind
96.9%Сам.
V*
93.7%Сам.
AI2D
92.9%Сам.
MMBench-V1.1
92.6%Сам.
RefCOCO-avg
0.91 / 100Сам.
OCRBench
89.4%Сам.
OmniDocBench 1.5
88.9%Сам.
VideoMME w sub.
87.0%Сам.
EmbSpatialBench
0.84 / 100Сам.
RealWorldQA
83.7%Сам.
LingoQA
82.0%Сам.
CC-OCR
81.0%Сам.
MMStar
81.0%Сам.
SlakeVQA
80.0%Сам.
MMMU-Pro
75.0%Сам.
MVBench
74.6%Сам.
LVBench
73.6%Сам.
MMVU
73.3%Сам.
ScreenSpot Pro
70.3%Сам.
Hallusion Bench
70.0%Сам.
RefSpatialBench
0.68 / 100Сам.
ERQA
60.5%Сам.
MMLongBench-Doc
0.60 / 100Сам.
SimpleVQA
0.56 / 100Сам.
BabyVision
44.6%Сам.
ODinW
41.1%Сам.
ZEROBench-Sub
0.36 / 100Сам.
SUNRGBD
0.35 / 100Сам.
Nuscene
15.2%Сам.
Hypersim
0.13 / 100Сам.
ZEROBench
0.10 / 100Сам.
Индексы оценки AA
(Artificial Analysis)Tau2(Sierra + U Toronto + Vector Institute (2025))93.9
Gpqa(NYU + Cohere + Anthropic (2023))85.8
Lcr(Artificial Analysis)77.7
Ifbench(Google Research (2023))75.6
Terminalbench Hard(Stanford × Laude Institute (2026))32.6
Hle(Center for AI Safety + Scale AI (2025))23.9
Intelligence Index(Artificial Analysis)22.9
Оценки категорий LLM Stats
(LLM Stats (zeroeval))Instruction Following90
Biology90
Chat80
Image To Text80
Language80
Legal80
Math80
Physics80
Structured Output80
Embodied80
Finance80
Grounding80
Chemistry80
Text-to-image80
Video80
Long Context70
Multimodal70
Reasoning70
Spatial Reasoning70
Frontend Development70
General70
Healthcare70
Economics70
Vision70
Search60
Agents60
Code60
Communication60
Tool Calling60
Spatial20
3d20
Цены
Цена ввода$0.3 / 1M токенов
Цена вывода$2.4 / 1M токенов
Смешанная цена (3:1)$0.825 / 1M токенов
Скорость
Токенов/сек0.0
Задержка первого токена0.00s
Время до первого ответа0.00s
Рейтинг цен провайдеров
Рейтинг цен провайдеров
4 провайдеров
Самый дешевый: DeepInfraСамый дорогой: Alibaba
ПровайдерВводВывод
1DeepInfraСамый дешевый
$0
$0
2Novita
$0
$0
3EmpirioLabs AI
$0.086
$0.688
4AlibabaОсновной
$0.3
$2.4
Сравнение цен разных API-провайдеров для этой модели.