Qwen3.8 Max
AlibabaQwenОткрытые весаQwen3.8-Max License · Коммерческое использование
Описание
Qwen3.8 Max, released as the Qwen3.8-2.4T-A95B open-weight checkpoint, is Qwen's flagship mixture-of-experts model for coding, research, professional workflows, and long-horizon agents. It has 2.4 trillion total parameters with 95 billion active parameters, a native 262,144-token context window extensible to about 1 million tokens, and always-on thinking. QwenCloud serves the same model in the Qwen3.8 Max API family with text and image input.
Дата выхода
2026-08-03
Параметры
2.4T
Длина контекста
1.0M
Модальности
image, pdf, text, video
Радар способностей
55
general
69
coding
93
reasoning
69
science
60
agents
90
multimodal
Рейтинги
| Домен | #Место | Оценка | Источник |
|---|---|---|---|
| Агентные возможности | 4 | 79.0 | LS |
| Рейтинг кодинга | 26 | 91.0 | AA |
| Общий рейтинг | 8 | 92.0 | AA |
| Математическое мышление | 17 | 91.0 | LB |
| Мультимодальный рейтинг | 10 | 65.0 | LS |
| Рассуждения | 13 | 88.0 | LB |
| Наука | 26 | 87.0 | AA |
Оценки бенчмарков (LLM Stats)
(LLM Stats (zeroeval))Agents
QwenReactBench
1724.00 / 2000Сам.
QwenSVG
1713.00 / 2000Сам.
PaperBench
93.0%Сам.
Terminal-Bench 2.1
86.6%Сам.
OSWorld-Verified
86.1%Сам.
AndroidWorld
85.3%Сам.
WideSearch
81.9%Сам.
QwenSWEBench
80.7%Сам.
MobileWorld
77.8%Сам.
AndroidBench
75.1%Сам.
CoWorkBench
74.8%Сам.
FrontierSWE
73.5%Сам.
Toolathlon
72.5%Сам.
SkillsBench
70.2%Сам.
Workspace Bench
67.7%Сам.
SWE-Bench ProPrinceton NLP (2024)
67.7%Сам.
QwenQoderBench
58.4%Сам.
DeepSWE 1.1
56.6%Сам.
NL2Repo
55.9%Сам.
Job Bench
53.4%Сам.
OneMillion Bench
52.5%Сам.
Agents' Last Exam
52.4%Сам.
MLS-Bench Lite
41.0%Сам.
AutomationBench
27.3%Сам.
Biology
GPQANYU + Cohere + Anthropic (2023)
92.6%Сам.
Code
Vision2Web
69.0%Сам.
Finance
PRBench-Finance
58.3%Сам.
General
MRCR v2 (8-needle)
92.9%Сам.
IFBench
82.8%Сам.
MMMU-Pro
82.3%Сам.
LongBench v2
66.3%Сам.
Grounding
ScreenSpot Pro
84.5%Сам.
Healthcare
HealthBench
60.2%Сам.
Knowledge
PLawBench
73.2%Сам.
PRBench-Legal
57.6%Сам.
Long Context
LVBench
81.8%Сам.
Math
Humanity's Last Exam (with tools, text-only)
56.2%Сам.
Humanity's Last Exam
43.6%Сам.
Multimodal
VideoMME w sub.
90.4%Сам.
PerceptionBench
63.5%Сам.
Reasoning
ERQA
77.8%Сам.
Spatial Reasoning
RealWorldQA
88.0%Сам.
Индексы оценки AA
(Artificial Analysis)Coding Index(Artificial Analysis)71.8
Intelligence Index(Artificial Analysis)58.1
Gpqa(NYU + Cohere + Anthropic (2023))0.9
Terminalbench V2 10.8
Lcr(Artificial Analysis)0.7
Scicode(UIUC + Argonne National Lab (2024))0.5
Tau Banking0.5
Hle(Center for AI Safety + Scale AI (2025))0.4
Оценки категорий LLM Stats
(LLM Stats (zeroeval))Physics90
Biology90
Chemistry90
Video90
Multimodal80
Search80
Spatial Reasoning80
Instruction Following80
Grounding80
Vision80
Long Context70
Reasoning70
Structured Output70
General70
Agents70
Code70
Productivity60
Healthcare60
Tool Calling60
Math50
Цены
Цена ввода$2 / 1M токенов
Цена вывода$6 / 1M токенов
Смешанная цена (3:1)$3 / 1M токенов
Цена чтения кэша$0.25 / 1M токенов
Цена записи кэша$2.5 / 1M токенов
Скорость
Токенов/сек45.2
Задержка первого токена1.95s
Время до первого ответа46.22s
Рейтинг цен провайдеров
Рейтинг цен провайдеров
13 провайдеров
Самый дешевый: AIHubMixСамый дорогой: Charm Hyper
ПровайдерВводВывод
1AIHubMixСамый дешевый
$1.69
$5.07
2Alibaba (China)
$1.77744
$5.33231
3LLM Gateway
$1.815
$5.4461
4CrossModel
$1.88
$5.63
5AlibabaОсновной
$2
$6
6NanoGPT
$2
$6
7OpenRouter
$2
$6
8OpenCode Go
$2
$6
9Kilo Gateway
$2
$6
10DigitalOcean
$2
$6
11Merge Gateway
$2
$6
12EmpirioLabs AI
$2
$6
13Charm Hyper
$2
$6
Сравнение цен разных API-провайдеров для этой модели.