Перейти к основному содержанию

Qwen3.5 397B A17B (Non-reasoning)

AlibabaQwenОткрытые весаApache 2.0 · Коммерческое использование

Описание

Qwen3.5-397B-A17B is Qwen's flagship Mixture-of-Experts model with 397 billion total parameters and 17 billion activated parameters. It delivers state-of-the-art performance across knowledge, reasoning, coding, mathematics, multilingual understanding, instruction following, long context, and agent tasks.

Дата выхода
2026-02-16
Параметры
397.0B
Длина контекста
262K
Модальности
audio, image, text, video

Радар способностей

21
general
70
coding
86
reasoning
66
science
60
agents
70
multimodal

Рейтинги

Домен#МестоОценкаИсточник
Агентные возможности17
62.0
LS
Рейтинг кодинга216
64.0
AA
Общий рейтинг211
52.0
AA
Наука195
60.0
AA

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Agents

t2-bench86.7%Сам.
VITA-Bench49.7%Сам.
MCP-Mark46.1%Сам.
Toolathlon38.3%Сам.
DeepPlanning34.3%Сам.

Chat

IFEvalGoogle Research (2023)92.6%Сам.
Multi-Challenge67.6%Сам.

Code

SecCodeBench68.3%Сам.

General

C-Eval93.0%Сам.
MAXIFE88.2%Сам.
Include85.6%Сам.
NOVA-6359.1%Сам.

Instruction Following

IFBench76.5%Сам.

Language

MMLU-Redux94.9%Сам.
MMMLU88.5%Сам.
MMLU-Pro87.8%Сам.
MMLU-ProX84.7%Сам.
WMT24++78.9%Сам.

Long Context

LongBench v263.2%Сам.

Math

HMMT 202594.8%Сам.
HMMT2592.7%Сам.
AIME 202691.3%Сам.
IMO-AnswerBench80.9%Сам.
PolyMATH73.3%Сам.

Reasoning

Global PIQA89.8%Сам.
GPQANYU + Cohere + Anthropic (2023)88.4%Сам.
LiveCodeBench v683.6%Сам.
SWE-Bench Verified76.4%Сам.
SuperGPQA70.4%Сам.
BrowseComp-zh70.3%Сам.
SWE-bench Multilingual69.3%Сам.
BrowseCompOpenAI (2025)69.0%Сам.
AA-LCR68.7%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)52.5%Сам.
Seal-046.9%Сам.
Humanity's Last Exam28.7%Сам.

Search

WideSearch74.0%Сам.

Tool Calling

BFCL-V472.9%Сам.

Индексы оценки AA

(Artificial Analysis)
Gpqa(NYU + Cohere + Anthropic (2023))
86.1
Tau2(Sierra + U Toronto + Vector Institute (2025))
83.9
Lcr(Artificial Analysis)
64.3
Ifbench(Google Research (2023))
51.6
Terminalbench Hard(Stanford × Laude Institute (2026))
35.6
Intelligence Index(Artificial Analysis)
21.4
Hle(Center for AI Safety + Scale AI (2025))
19.8

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Language
90
Biology
90
Chat
80
Instruction Following
80
Legal
80
Math
80
Physics
80
Structured Output
80
Finance
80
Frontend Development
80
Healthcare
80
Chemistry
80
Long Context
70
Multimodal
70
Reasoning
70
Search
70
Spatial Reasoning
70
General
70
Code
70
Communication
70
Economics
70
Agents
60
Tool Calling
60
Vision
50

Цены

Цена ввода$0.6 / 1M токенов
Цена вывода$3.6 / 1M токенов
Смешанная цена (3:1)$1.35 / 1M токенов

Скорость

Токенов/сек86.1
Задержка первого токена1.70s
Время до первого ответа1.70s

Рейтинг цен провайдеров

Рейтинг цен провайдеров

2 провайдеров

Самый дешевый: DeepInfraСамый дорогой: Alibaba
ПровайдерВводВывод
1DeepInfraСамый дешевый
$0
$0
2AlibabaОсновной
$0.6
$3.6

Сравнение цен разных API-провайдеров для этой модели.

Внешние ссылки