Qwen3.7 Max
AlibabaQwenProprietary
Описание
Qwen3.7 Max is Alibaba Cloud Qwen Team's proprietary flagship model for agent-driven workflows. It is designed for coding agents, office automation, MCP and multi-agent orchestration, and long-horizon autonomous execution, with a 1 million token context window and up to 65,536 output tokens. Qwen reports strong agentic coding results including 69.7 on Terminal-Bench 2.0-Terminus, 80.4 on SWE-bench Verified, 60.6 on SWE-Pro, and 78.3 on SWE-Multilingual, alongside 92.4 on GPQA Diamond and 97.1 on HMMT 2026 Feb.
Дата выхода
2026-05-19
Параметры
—
Длина контекста
1.0M
Модальности
text
Радар способностей
45
general
63
coding
92
reasoning
67
science
70
agents
0
multimodal
Рейтинги
| Домен | #Место | Оценка | Источник |
|---|---|---|---|
| Агентные возможности | 5 | 66.0 | LS |
| Рейтинг кодинга | 55 | 84.0 | AA |
| Общий рейтинг | 31 | 85.0 | AA |
| Математическое мышление | 30 | 85.0 | LB |
| Рассуждения | 26 | 83.0 | LB |
| Наука | 48 | 83.0 | AA |
Оценки бенчмарков (LLM Stats)
(LLM Stats (zeroeval))Agents
QwenSVG
1608.00 / 2000Сам.
Kernel Bench L3
96.0%Сам.
SpreadSheetBench-v1
87.0%Сам.
CoWorkBench
67.2%Сам.
MCP-Mark
60.8%Сам.
QwenWorldBench
57.3%Сам.
Finance Agent v2
48.4%
VITA-Bench
47.9%Сам.
Chat
IFEvalGoogle Research (2023)
94.3%Сам.
Code
QwenWebBench
1568.00 / 2000Сам.
Claw-Eval
65.2%Сам.
ZClawBench
64.3%Сам.
SkillsBench
59.2%Сам.
NL2Repo
47.2%Сам.
General
MAXIFE
89.2%Сам.
Include
86.2%Сам.
NOVA-63
59.0%Сам.
Instruction Following
IFBench
79.1%Сам.
Language
MMLU-Redux
95.0%Сам.
MMMLU
90.3%Сам.
MMLU-Pro
89.6%Сам.
MMLU-ProX
87.0%Сам.
WMT24++
85.8%Сам.
Long Context
MRCR 128K (8-needle)
90.4%Сам.
Math
HMMT Feb 26
97.1%Сам.
IMO-AnswerBench
90.0%Сам.
PolyMATH
86.5%Сам.
LiveBench
74.3%
MathArena Apex
44.5%Сам.
Reasoning
GPQANYU + Cohere + Anthropic (2023)
92.4%Сам.
LiveCodeBench v6
91.6%Сам.
Global PIQA
91.4%Сам.
SWE-Bench Verified
80.4%Сам.
SWE-bench Multilingual
78.3%Сам.
MCP Atlas
76.4%Сам.
SuperGPQA
73.6%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)
69.7%Сам.
SWE-Bench ProPrinceton NLP (2024)
60.6%Сам.
SciCode
53.5%Сам.
Humanity's Last Exam
41.4%Сам.
CritPT
11.4%Сам.
Tool Calling
BFCL-V4
75.0%Сам.
Индексы оценки AA
(Artificial Analysis)Tau2(Sierra + U Toronto + Vector Institute (2025))94.7
Gpqa(NYU + Cohere + Anthropic (2023))92.3
Ifbench(Google Research (2023))80.5
Lcr(Artificial Analysis)74.7
Terminalbench V2 174.5
Coding Index(Artificial Analysis)66.0
Terminalbench Hard(Stanford × Laude Institute (2026))50.8
Scicode(UIUC + Argonne National Lab (2024))48.8
Intelligence Index(Artificial Analysis)46.7
Hle(Center for AI Safety + Scale AI (2025))40.5
Tau Banking11.8
Оценки категорий LLM Stats
(LLM Stats (zeroeval))Chat90
Language90
Multimodal90
Spatial Reasoning90
Structured Output90
Instruction Following90
Legal80
Physics80
Productivity80
Frontend Development80
Healthcare80
Math70
Reasoning70
Finance70
General70
Biology70
Chemistry70
Code70
Economics70
Tool Calling70
Agents60
Vision60
Цены
Цена ввода$2.5 / 1M токенов
Цена вывода$7.5 / 1M токенов
Смешанная цена (3:1)$3.75 / 1M токенов
Цена чтения кэша$0.5 / 1M токенов
Цена записи кэша$3.125 / 1M токенов
Скорость
Токенов/сек0.0
Задержка первого токена0.00s
Время до первого ответа0.00s
Рейтинг цен провайдеров
Рейтинг цен провайдеров
24 провайдеров
Самый дешевый: NovitaСамый дорогой: Modelis
ПровайдерВводВывод
1NovitaСамый дешевый
$0
$0
2Together
$0
$0.00001
3Merge Gateway
$0.825
$2.4755
4NovitaAI
$1.25
$3.75
5Kilo Gateway
$1.25
$3.75
6DevPass (LLM Gateway)
$1.25
$3.75
7OrcaRouter
$1.25
$3.75
8Pioneer
$1.25
$3.75
9OpenRouter
$1.475
$4.425
10CrossModel
$1.504
$4.504
11AIHubMix
$1.69
$5.07
12AlibabaОсновной
$2.5
$7.5
13NanoGPT
$2.5
$7.5
14Abacus
$2.5
$7.5
15OpenCode Go
$2.5
$7.5
16Alibaba (China)
$2.5
$7.5
17ZenMux
$2.5
$7.5
18Alibaba Coding Plan
$2.5
$7.5
19Requesty
$2.5
$7.5
20Alibaba Coding Plan (China)
$2.5
$7.5
21EmpirioLabs AI
$2.5
$7.5
22Charm Hyper
$2.5
$7.5
23Impossibl
$2.5
$7.5
24Modelis
$3
$9
Сравнение цен разных API-провайдеров для этой модели.