Перейти к основному содержанию

DeepSeek V4 Flash 0731 (Reasoning, Max Effort)

DeepSeekDeepSeekОткрытые весаMIT · Коммерческое использование

Описание

DeepSeek-V4-Flash-Max is the maximum reasoning effort mode of DeepSeek-V4-Flash, a 284B-parameter MoE model with 13B activated parameters and a 1M-token context window. Sharing the V4 series' hybrid attention architecture (Compressed Sparse Attention combined with Heavily Compressed Attention), Manifold-Constrained Hyper-Connections, and Muon optimizer, V4-Flash-Max delivers reasoning performance comparable to V4-Pro when given a larger thinking budget while operating at a fraction of the parameter scale. It is pre-trained on more than 32T tokens and post-trained with a two-stage paradigm of domain-specific expert cultivation followed by on-policy distillation.

Дата выхода
2026-07-31
Параметры
284.0B
Длина контекста
1.0M
Модальности
text

Радар способностей

49
general
66
coding
91
reasoning
66
science
60
agents
0
multimodal

Рейтинги

Домен#МестоОценкаИсточник
Агентные возможности74
45.0
LS
Рейтинг кодинга35
88.0
AA
Общий рейтинг34
82.0
AA
Наука47
82.0
AA

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Agents

Terminal-Bench 2.182.7%Сам.
CyberGym76.7%Сам.
BrowseCompOpenAI (2025)73.2%Сам.
MCP Atlas69.0%Сам.
DSBench-FullStack68.7%Сам.
DSBench-Hard59.6%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)56.9%Сам.
DeepSWE54.4%Сам.
NL2Repo54.2%Сам.
SWE-Bench ProPrinceton NLP (2024)52.6%Сам.
Toolathlon47.8%Сам.
Agents' Last Exam25.2%Сам.
AutomationBench25.1%Сам.

Biology

GPQANYU + Cohere + Anthropic (2023)88.1%Сам.

Code

LiveCodeBench91.6%Сам.
SWE-Bench Verified79.0%Сам.
SWE-bench Multilingual73.3%Сам.

Factuality

SimpleQA34.1%Сам.

Finance

MMLU-Pro86.2%Сам.

General

CSimpleQA78.9%Сам.
MRCR 1M78.7%Сам.
CorpusQA 1M60.5%Сам.

Math

CodeForces1.00 / 3000Сам.
HMMT Feb 2694.8%Сам.
IMO-AnswerBench88.4%Сам.
MathArena Apex85.7%Сам.
Humanity's Last Exam45.1%Сам.

Индексы оценки AA

(Artificial Analysis)
Coding Index(Artificial Analysis)
69.1
Intelligence Index(Artificial Analysis)
51.8
Gpqa(NYU + Cohere + Anthropic (2023))
0.9
Terminalbench V2 1
0.8
Lcr(Artificial Analysis)
0.7
Scicode(UIUC + Argonne National Lab (2024))
0.5
Tau Banking
0.4
Hle(Center for AI Safety + Scale AI (2025))
0.4

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Legal
90
Physics
90
Finance
90
Healthcare
90
Biology
90
Chemistry
90
Math
80
Language
80
Frontend Development
80
Long Context
70
Reasoning
70
Search
70
General
70
Code
70
Agents
60
Tool Calling
60
Vision
50
Factuality
30

Цены

Цена ввода$0.14 / 1M токенов
Цена вывода$0.28 / 1M токенов
Смешанная цена (3:1)$0.175 / 1M токенов
Цена чтения кэша$0.0028 / 1M токенов

Скорость

Токенов/сек109.1
Задержка первого токена0.96s
Время до первого ответа19.29s

Рейтинг цен провайдеров

Рейтинг цен провайдеров

8 провайдеров

Самый дешевый: DeepSeekСамый дорогой: TensorX
ПровайдерВводВывод
1DeepSeekСамый дешевый
$0
$0
2OpenRouter
$0.08
$0.18
3NanoGPT
$0.14
$0.28
4Kilo Gateway
$0.14
$0.28
5Ambient
$0.14
$0.28
6Merge Gateway
$0.14
$0.28
7Vercel AI Gateway
$0.2
$0.4
8TensorX
$0.25
$0.3

Сравнение цен разных API-провайдеров для этой модели.

Внешние ссылки