Перейти к основному содержанию

DeepSeek R1 Distill Qwen 7B

DeepSeekDeepSeekОткрытые весаMIT · Коммерческое использование

Описание

DeepSeek-R1 is the first-generation reasoning model built atop DeepSeek-V3 (671B total parameters, 37B activated per token). It incorporates large-scale reinforcement learning (RL) to enhance its chain-of-thought and reasoning capabilities, delivering strong performance in math, code, and multi-step reasoning tasks.

Дата выхода
2025-01-20
Параметры
7.6B
Длина контекста
Модальности

Радар способностей

70
general
40
coding
90
reasoning
43
scienceоцен.
75
agents
0
multimodal

При отсутствии специализированных научных бенчмарков Science оценивается по научным категориям LLM Stats или на основе рассуждений.

Рейтинги

Нет данных рейтинга

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Biology

GPQANYU + Cohere + Anthropic (2023)49.1%Сам.

Code

LiveCodeBench37.6%Сам.

Math

MATH-50092.8%Сам.
AIME 202483.3%Сам.

Индексы оценки AA

(Artificial Analysis)

Нет данных AA оценки

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Math
90
Reasoning
70
General
70
Physics
50
Biology
50
Chemistry
50
Code
40

Цены

Нет данных о ценах

Скорость

Нет данных о скорости

Рейтинг цен провайдеров

Рейтинг цен провайдеров

1 провайдеров

ПровайдерВводВывод
1Alibaba (China)
$0.072
$0.144

Сравнение цен разных API-провайдеров для этой модели.

Внешние ссылки