DeepSeek VL2 Small
DeepSeekDeepSeekOpen Weightdeepseek
説明
An advanced series of large Mixture-of-Experts (MoE) Vision-Language Models that significantly improves upon its predecessor, DeepSeek-VL. DeepSeek-VL2 demonstrates superior capabilities across various tasks, including but not limited to visual question answering, optical character recognition, document/table/chart understanding, and visual grounding.
リリース日
2024-12-13
パラメータ
16.0B
コンテキスト長
164K
モダリティ
text
能力レーダー
60
general
0
coding
60
reasoning
43
science推定
0
agents
0
multimodal
専門的な科学ベンチマークが利用できない場合、Scienceは推論プロキシを使用して推定します。
ランキング
| ドメイン | #順位 | スコア | ソース |
|---|---|---|---|
| Multimodal Ranking | 48 | 75.0 | LS |
ベンチマークスコア (LLM Stats)
General
MMT-Bench
62.9%自己申告
MMStar
57.0%自己申告
MMMU
48.0%自己申告
Image To Text
DocVQA
92.3%自己申告
TextVQA
83.4%自己申告
OCRBench
83.4%自己申告
Math
MathVista
60.7%自己申告
Multimodal
ChartQA
84.5%自己申告
MMBench
80.3%自己申告
AI2D
80.0%自己申告
MMBench-V1.1
79.3%自己申告
InfoVQA
75.8%自己申告
MME
21.2%自己申告
Spatial Reasoning
RealWorldQA
65.4%自己申告
AA評価指数
AA評価データがありません
LLM Statsカテゴリスコア
Image To Text90
Spatial Reasoning70
Vision70
Multimodal70
General60
Math60
Reasoning60
Healthcare50
価格設定
入力価格$0.32 / 1M tokens
出力価格$0.89 / 1M tokens
混合価格(3:1)$0.4625 / 1M tokens
速度
速度データがありません
利用可能なプロバイダー
(LS内部単位)プロバイダーデータがありません