Перейти к основному содержанию

Qwen3.8 Max

AlibabaQwenОткрытые весаQwen3.8-Max License · Коммерческое использование

Описание

Qwen3.8 Max, released as the Qwen3.8-2.4T-A95B open-weight checkpoint, is Qwen's flagship mixture-of-experts model for coding, research, professional workflows, and long-horizon agents. It has 2.4 trillion total parameters with 95 billion active parameters, a native 262,144-token context window extensible to about 1 million tokens, and always-on thinking. QwenCloud serves the same model in the Qwen3.8 Max API family with text and image input.

Дата выхода
2026-08-03
Параметры
2.4T
Длина контекста
1.0M
Модальности
image, pdf, text, video

Радар способностей

55
general
69
coding
93
reasoning
69
science
60
agents
90
multimodal

Рейтинги

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Agents

QwenReactBench1724.00 / 2000Сам.
QwenSVG1713.00 / 2000Сам.
PaperBench93.0%Сам.
Terminal-Bench 2.186.6%Сам.
OSWorld-Verified86.1%Сам.
AndroidWorld85.3%Сам.
WideSearch81.9%Сам.
QwenSWEBench80.7%Сам.
MobileWorld77.8%Сам.
AndroidBench75.1%Сам.
CoWorkBench74.8%Сам.
FrontierSWE73.5%Сам.
Toolathlon72.5%Сам.
SkillsBench70.2%Сам.
Workspace Bench67.7%Сам.
SWE-Bench ProPrinceton NLP (2024)67.7%Сам.
QwenQoderBench58.4%Сам.
DeepSWE 1.156.6%Сам.
NL2Repo55.9%Сам.
Job Bench53.4%Сам.
OneMillion Bench52.5%Сам.
Agents' Last Exam52.4%Сам.
MLS-Bench Lite41.0%Сам.
AutomationBench27.3%Сам.

Biology

GPQANYU + Cohere + Anthropic (2023)92.6%Сам.

Code

Vision2Web69.0%Сам.

Finance

PRBench-Finance58.3%Сам.

General

MRCR v2 (8-needle)92.9%Сам.
IFBench82.8%Сам.
MMMU-Pro82.3%Сам.
LongBench v266.3%Сам.

Grounding

ScreenSpot Pro84.5%Сам.

Healthcare

HealthBench60.2%Сам.

Knowledge

PLawBench73.2%Сам.
PRBench-Legal57.6%Сам.

Long Context

LVBench81.8%Сам.

Math

Humanity's Last Exam (with tools, text-only)56.2%Сам.
Humanity's Last Exam43.6%Сам.

Multimodal

VideoMME w sub.90.4%Сам.
PerceptionBench63.5%Сам.

Reasoning

ERQA77.8%Сам.

Spatial Reasoning

RealWorldQA88.0%Сам.

Индексы оценки AA

(Artificial Analysis)
Coding Index(Artificial Analysis)
71.8
Intelligence Index(Artificial Analysis)
58.1
Gpqa(NYU + Cohere + Anthropic (2023))
0.9
Terminalbench V2 1
0.8
Lcr(Artificial Analysis)
0.7
Scicode(UIUC + Argonne National Lab (2024))
0.5
Tau Banking
0.5
Hle(Center for AI Safety + Scale AI (2025))
0.4

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Physics
90
Biology
90
Chemistry
90
Video
90
Multimodal
80
Search
80
Spatial Reasoning
80
Instruction Following
80
Grounding
80
Vision
80
Long Context
70
Reasoning
70
Structured Output
70
General
70
Agents
70
Code
70
Productivity
60
Healthcare
60
Tool Calling
60
Math
50

Цены

Цена ввода$2 / 1M токенов
Цена вывода$6 / 1M токенов
Смешанная цена (3:1)$3 / 1M токенов
Цена чтения кэша$0.25 / 1M токенов
Цена записи кэша$2.5 / 1M токенов

Скорость

Токенов/сек45.2
Задержка первого токена1.95s
Время до первого ответа46.22s

Рейтинг цен провайдеров

Рейтинг цен провайдеров

13 провайдеров

Самый дешевый: AIHubMixСамый дорогой: Charm Hyper
ПровайдерВводВывод
1AIHubMixСамый дешевый
$1.69
$5.07
2Alibaba (China)
$1.77744
$5.33231
3LLM Gateway
$1.815
$5.4461
4CrossModel
$1.88
$5.63
5AlibabaОсновной
$2
$6
6NanoGPT
$2
$6
7OpenRouter
$2
$6
8OpenCode Go
$2
$6
9Kilo Gateway
$2
$6
10DigitalOcean
$2
$6
11Merge Gateway
$2
$6
12EmpirioLabs AI
$2
$6
13Charm Hyper
$2
$6

Сравнение цен разных API-провайдеров для этой модели.

Внешние ссылки