Saltar al contenido principal

Seed 2.0 Mini

ByteDanceProprietary

Descripción

Built for low-latency, high-concurrency, cost-sensitive use cases, with flexible deployment, four-tier thinking, and multimodal

Fecha de lanzamiento
2026-02-17
Parámetros
Longitud del contexto
262K
Modalidades
image, text, video

Radar de capacidades

21
general
10
coding
100
reasoning
68
scienceest.
10
agents
70
multimodal

Science se estima a partir de las puntuaciones científicas de LLM Stats o del razonamiento cuando no hay benchmarks científicos dedicados.

Rankings

Dominio#PosiciónPuntuaciónFuente
Ranking multimodal124
34.0
LS

Puntuaciones de benchmarks (LLM Stats)

(LLM Stats (zeroeval))

Chat

Multi-Challenge61.1%Aut.

Chemistry

SuperChem16.2%Aut.

Code

CL-bench14.8%Aut.

Coding

AetherCode29.8%Aut.

Factuality

SimpleQA Verified18.9%Aut.

General

LongFact Concepts91.4%Aut.
LongFact Objects87.0%Aut.

Healthcare

HealthBench30.0%Aut.
HealthBench Hard15.3%Aut.

Language

COLLIE91.2%Aut.
MMLU-Pro83.6%Aut.
MMMLU81.6%Aut.

Long Context

MRCR v2 (8-needle)51.4%Aut.

Math

CodeForces1644.00 / 3000Aut.
AIME 202587.0%Aut.
AIME 202686.7%Aut.
MathVista-Mini85.5%Aut.
MathVision78.1%Aut.
Beyond AIME69.0%Aut.
DynaMath58.9%Aut.
MathArena Apex4.2%Aut.

Multimodal

VideoMMMU80.6%Aut.
MMMU79.7%Aut.

Physics

PHYBench56.0%Aut.

Reasoning

Graphwalks parents <128k93.0%Aut.
CharXiv-D91.9%Aut.
Global PIQA89.2%Aut.
FRAMES80.5%Aut.
GPQANYU + Cohere + Anthropic (2023)79.0%Aut.
CharXiv-R70.8%Aut.
LiveCodeBench v664.1%Aut.
Graphwalks BFS <128k64.1%Aut.
SuperGPQA61.6%Aut.
FActScoreMin et al. (NYU/UW, 2023)50.4%Aut.
FrontierScience Olympiad44.0%Aut.
ARC-AGI29.8%Aut.
Humanity's Last Exam (no tools, text-only)13.3%Aut.
FrontierScience Research3.3%Aut.
ArcAGI22.3%Aut.
ARC-AGI v21.5%Aut.

Video

LiveSports-3K73.3%Aut.
OVOBench70.4%Aut.
VideoSimpleQA67.7%Aut.
OVBench60.1%Aut.
VideoHolmes58.6%Aut.
CrossVid58.6%Aut.
ContPhy55.9%Aut.
Minerva54.7%Aut.
TOMATO47.4%Aut.

Vision

CountBench0.95 / 100Aut.
VLMsAreBlind93.1%Aut.
TempCompass83.7%Aut.
RealWorldQA81.6%Aut.
VideoMME w sub.81.2%Aut.
MMStar79.1%Aut.
MuirBench78.0%Aut.
LongVideoBench74.8%Aut.
BLINK73.4%Aut.
MMMU-Pro71.4%Aut.
TVBench70.5%Aut.
MMVU69.0%Aut.
DUDE68.9%Aut.
SimpleVQA0.69 / 100Aut.
LVBench66.6%Aut.
ChartQAPro65.2%Aut.
Hallusion Bench65.1%Aut.
MotionBench64.4%Aut.
OCRBench_V258.5%Aut.
VLMsAreBiased58.4%Aut.
TreeBench57.3%Aut.
EMMA57.0%Aut.
ERQA56.3%Aut.
HiPhO55.8%Aut.
RefSpatialBench0.56 / 100Aut.
MTVQA50.6%Aut.
MMLongBench-Doc0.49 / 100Aut.
WorldVQA47.6%Aut.
VisuLogic0.40 / 100Aut.
BabyVision38.7%Aut.
ZEROBench-Sub0.36 / 100Aut.
VisFactor23.6%Aut.
OmniDocBench 1.511.0%Aut.
ZEROBench0.07 / 100Aut.

Índices de evaluación AA

(Artificial Analysis)

No hay datos de evaluación AA disponibles

Puntuaciones por categoría LLM Stats

(LLM Stats (zeroeval))
Math
100
Reasoning
28
General
21
Language
90
Writing
90
Search
80
Biology
80
Legal
70
Physics
70
Finance
70
3d
70
Chat
60
Image To Text
60
Long Context
60
Multimodal
60
Spatial Reasoning
60
Grounding
60
Healthcare
60
Communication
60
Economics
60
Video
60
Vision
60
Structured Output
50
Chemistry
50
Knowledge
40
Science
30
Coding
30
Factuality
20
Agents
10
Code
10

Precios

Precio de entrada$0 / 1M tokens
Precio de salida$0 / 1M tokens
Precio mixto (3:1)$0 / 1M tokens

Velocidad

No hay datos de velocidad disponibles

Ranking de Precios por Proveedor

Ranking de Precios por Proveedor

5 proveedores

Más barato: ByteDanceMás caro: Requesty
ProveedorEntradaSalida
1ByteDancePRINCIPAL
$0
$0
2DeepInfra
$0
$0
3OpenRouter
$0.1
$0.4
4Kilo Gateway
$0.1
$0.4
5Requesty
$0.1
$0.4

Comparar precios entre diferentes proveedores de API para este modelo.

Fuentes externas