跳转到主要内容

Seed 2.0 Mini

ByteDanceProprietary

描述

Built for low-latency, high-concurrency, cost-sensitive use cases, with flexible deployment, four-tier thinking, and multimodal

发布日期
2026-02-17
参数规模
上下文长度
262K
支持模态
image, text, video

能力雷达图

21
general
10
coding
100
reasoning
68
science估算
10
agents
70
multimodal

缺少专门科学评测时,Science 由 LLM Stats 科学得分或推理能力估算。

排行榜排名

领域#排名分数来源
多模态榜124
34.0
LS

基准测试分数 (LLM Stats)

(LLM Stats (zeroeval))

Chat

Multi-Challenge61.1%自报

Chemistry

SuperChem16.2%自报

Code

CL-bench14.8%自报

Coding

AetherCode29.8%自报

Factuality

SimpleQA Verified18.9%自报

General

LongFact Concepts91.4%自报
LongFact Objects87.0%自报

Healthcare

HealthBench30.0%自报
HealthBench Hard15.3%自报

Language

COLLIE91.2%自报
MMLU-Pro83.6%自报
MMMLU81.6%自报

Long Context

MRCR v2 (8-needle)51.4%自报

Math

CodeForces1644.00 / 3000自报
AIME 202587.0%自报
AIME 202686.7%自报
MathVista-Mini85.5%自报
MathVision78.1%自报
Beyond AIME69.0%自报
DynaMath58.9%自报
MathArena Apex4.2%自报

Multimodal

VideoMMMU80.6%自报
MMMU79.7%自报

Physics

PHYBench56.0%自报

Reasoning

Graphwalks parents <128k93.0%自报
CharXiv-D91.9%自报
Global PIQA89.2%自报
FRAMES80.5%自报
GPQANYU + Cohere + Anthropic (2023)79.0%自报
CharXiv-R70.8%自报
LiveCodeBench v664.1%自报
Graphwalks BFS <128k64.1%自报
SuperGPQA61.6%自报
FActScoreMin et al. (NYU/UW, 2023)50.4%自报
FrontierScience Olympiad44.0%自报
ARC-AGI29.8%自报
Humanity's Last Exam (no tools, text-only)13.3%自报
FrontierScience Research3.3%自报
ArcAGI22.3%自报
ARC-AGI v21.5%自报

Video

LiveSports-3K73.3%自报
OVOBench70.4%自报
VideoSimpleQA67.7%自报
OVBench60.1%自报
VideoHolmes58.6%自报
CrossVid58.6%自报
ContPhy55.9%自报
Minerva54.7%自报
TOMATO47.4%自报

Vision

CountBench0.95 / 100自报
VLMsAreBlind93.1%自报
TempCompass83.7%自报
RealWorldQA81.6%自报
VideoMME w sub.81.2%自报
MMStar79.1%自报
MuirBench78.0%自报
LongVideoBench74.8%自报
BLINK73.4%自报
MMMU-Pro71.4%自报
TVBench70.5%自报
MMVU69.0%自报
DUDE68.9%自报
SimpleVQA0.69 / 100自报
LVBench66.6%自报
ChartQAPro65.2%自报
Hallusion Bench65.1%自报
MotionBench64.4%自报
OCRBench_V258.5%自报
VLMsAreBiased58.4%自报
TreeBench57.3%自报
EMMA57.0%自报
ERQA56.3%自报
HiPhO55.8%自报
RefSpatialBench0.56 / 100自报
MTVQA50.6%自报
MMLongBench-Doc0.49 / 100自报
WorldVQA47.6%自报
VisuLogic0.40 / 100自报
BabyVision38.7%自报
ZEROBench-Sub0.36 / 100自报
VisFactor23.6%自报
OmniDocBench 1.511.0%自报
ZEROBench0.07 / 100自报

AA 评测指数

(Artificial Analysis)

暂无 AA 评测数据

LLM Stats 分类评分

(LLM Stats (zeroeval))
Math
100
Reasoning
28
General
21
Language
90
Writing
90
Search
80
Biology
80
Legal
70
Physics
70
Finance
70
3d
70
Chat
60
Image To Text
60
Long Context
60
Multimodal
60
Spatial Reasoning
60
Grounding
60
Healthcare
60
Communication
60
Economics
60
Video
60
Vision
60
Structured Output
50
Chemistry
50
Knowledge
40
Science
30
Coding
30
Factuality
20
Agents
10
Code
10

定价

输入价格$0 / 1M tokens
输出价格$0 / 1M tokens
混合价格(3:1)$0 / 1M tokens

速度

暂无速度数据

供应商价格排行

供应商价格排行

5 个供应商

最便宜: ByteDance最贵: Requesty
供应商输入输出
1ByteDance主要
$0
$0
2DeepInfra
$0
$0
3OpenRouter
$0.1
$0.4
4Kilo Gateway
$0.1
$0.4
5Requesty
$0.1
$0.4

比较该模型在不同 API 供应商之间的定价。

外部链接