Перейти к основному содержанию

DeepSeek R1 0528 (May '25)

DeepSeekDeepSeekОткрытые весаMIT · Коммерческое использование

Описание

DeepSeek-R1-0528 is the May 28, 2025 version of DeepSeek's reasoning model. It features advanced thinking capabilities and serves as a benchmark comparison for newer models like DeepSeek-V3.1. This model excels in complex reasoning tasks, mathematical problem-solving, and code generation through its thinking mode approach.

Дата выхода
2025-05-28
Параметры
671.0B
Длина контекста
164K
Модальности
text

Радар способностей

35
general
77
coding
83
reasoning
61
science
10
agents
0
multimodal

Рейтинги

Домен#МестоОценкаИсточник
Агентные возможности81
39.0
LS
Рейтинг кодинга258
57.0
AA
Общий рейтинг327
41.0
AA
Наука237
54.0
AA

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Agents

t2-bench80.2%Сам.
Toolathlon35.2%Сам.

Factuality

SimpleQA92.3%Сам.

General

Aider-Polyglot71.6%Сам.

Language

MMLU-Redux93.4%Сам.
MMLU-Pro85.0%Сам.

Math

AIME 202491.4%Сам.
AIME 202587.5%Сам.
HMMT 202579.4%Сам.
CodeForces0.64 / 3000Сам.

Reasoning

GPQANYU + Cohere + Anthropic (2023)81.0%Сам.
LiveCodeBench73.3%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)46.4%Сам.
SWE-Bench Verified44.6%Сам.
BrowseComp-zh35.7%Сам.
SWE-bench Multilingual30.5%Сам.
Humanity's Last Exam17.7%Сам.
BrowseCompOpenAI (2025)8.9%Сам.
Terminal-Bench5.7%Сам.

Индексы оценки AA

(Artificial Analysis)
Math 500(OpenAI (2024), subset of Hendrycks et al. MATH (2021))
98.3
Aime(MAA (Mathematical Association of America))
89.3
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
84.9
Gpqa(NYU + Cohere + Anthropic (2023))
81.3
Livecodebench(UC Berkeley + MIT + Cornell (2024))
77.0
Math Index(Artificial Analysis)
76.0
Aime 25(MAA (Mathematical Association of America))
76.0
Lcr(Artificial Analysis)
55.7
Ifbench(Google Research (2023))
39.6
Tau2(Sierra + U Toronto + Vector Institute (2025))
36.5
Terminalbench Hard(Stanford × Laude Institute (2026))
15.9
Hle(Center for AI Safety + Scale AI (2025))
15.8
Intelligence Index(Artificial Analysis)
13.1

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Language
90
Factuality
90
Legal
80
Physics
80
Finance
80
Healthcare
80
Biology
80
Chemistry
80
Math
70
Reasoning
60
General
60
Code
50
Frontend Development
40
Search
20
Vision
20
Agents
10

Цены

Цена ввода$1.35 / 1M токенов
Цена вывода$3 / 1M токенов
Смешанная цена (3:1)$1.763 / 1M токенов
Цена чтения кэша$0.35 / 1M токенов

Скорость

Токенов/сек0.0
Задержка первого токена0.00s
Время до первого ответа0.00s

Рейтинг цен провайдеров

Рейтинг цен провайдеров

11 провайдеров

Самый дешевый: DeepInfraСамый дорогой: Azure
ПровайдерВводВывод
1DeepInfraСамый дешевый
$0
$0
2NanoGPT
$0.4
$1.7
3OpenRouter
$0.5
$2.15
4Alibaba (China)
$0.574
$2.294
5TensorX
$0.66
$2.6
6Jiekou.AI
$0.7
$2.5
7NovitaAI
$0.7
$2.5
8Kilo Gateway
$0.7
$2.5
9DeepSeekОсновной
$1.35
$3
10Azure Cognitive Services
$1.35
$5.4
11Azure
$1.35
$5.4

Сравнение цен разных API-провайдеров для этой модели.

Внешние ссылки