DeepSeek R1 Distill Qwen 7B
DeepSeekDeepSeekOpen WeightMIT · Usage Commercial
Description
DeepSeek-R1 is the first-generation reasoning model built atop DeepSeek-V3 (671B total parameters, 37B activated per token). It incorporates large-scale reinforcement learning (RL) to enhance its chain-of-thought and reasoning capabilities, delivering strong performance in math, code, and multi-step reasoning tasks.
Date de sortie
2025-01-20
Paramètres
7.6B
Longueur du contexte
—
Modalités
—
Radar de capacités
70
general
40
coding
90
reasoning
43
scienceest.
75
agents
0
multimodal
Science est estimé à partir des scores scientifiques de LLM Stats ou du raisonnement lorsque les benchmarks scientifiques dédiés ne sont pas disponibles.
Classements
Aucune donnée de classement disponible
Scores de benchmarks (LLM Stats)
(LLM Stats (zeroeval))Biology
GPQANYU + Cohere + Anthropic (2023)
49.1%Aut.
Code
LiveCodeBench
37.6%Aut.
Math
MATH-500
92.8%Aut.
AIME 2024
83.3%Aut.
Indices d'évaluation AA
(Artificial Analysis)Aucune donnée d'évaluation AA disponible
Scores par catégorie LLM Stats
(LLM Stats (zeroeval))Math90
Reasoning70
General70
Physics50
Biology50
Chemistry50
Code40
Tarification
Aucune donnée de prix disponible
Vitesse
Aucune donnée de vitesse disponible
Classement des Prix par Fournisseur
Classement des Prix par Fournisseur
1 fournisseurs
FournisseurEntréeSortie
1Alibaba (China)
$0.072
$0.144
Comparer les prix entre différents fournisseurs API pour ce modèle.