Seed 1.8
ByteDanceProprietary
Descripción
Optimized specifically for multimodal agent scenarios. It features enhanced agent capabilities, upgraded multimodal comprehension, and more flexible context management.
Fecha de lanzamiento
2026-02-17
Parámetros
—
Longitud del contexto
—
Modalidades
image, text, video
Radar de capacidades
39
general
100
coding
70
reasoning
51
scienceest.
50
agents
70
multimodal
Science se estima a partir de las puntuaciones científicas de LLM Stats o del razonamiento cuando no hay benchmarks científicos dedicados.
Rankings
| Dominio | #Posición | Puntuación | Fuente |
|---|---|---|---|
| Capacidad agéntica | 85 | 37.0 | LS |
| Ranking multimodal | 91 | 48.0 | LS |
Puntuaciones de benchmarks (LLM Stats)
(LLM Stats (zeroeval))Agents
AndroidWorld
70.7%Aut.
Chat
Multi-Challenge
66.7%Aut.
Coding
AetherCode
38.2%Aut.
General
MMLU
92.3%Aut.
Language
MMLU-Pro
84.9%Aut.
Math
AIME 2025
94.3%Aut.
MathVista
87.7%Aut.
MathVision
81.3%Aut.
Beyond AIME
77.0%Aut.
DynaMath
61.5%Aut.
AMO Bench
60.0%Aut.
Multimodal
MMMU
83.4%Aut.
VideoMMMU
82.7%Aut.
OSWorld
61.9%Aut.
Physics
PHYBench
41.0%Aut.
Reasoning
LiveCodeBench Pro
1930.00 / 3000Aut.
BrowseComp-zh
81.3%Aut.
LiveCodeBench v6
79.5%Aut.
SWE-Bench Verified
72.9%Aut.
CharXiv-R
71.4%Aut.
ARC-AGI
67.9%Aut.
BrowseCompOpenAI (2025)
67.6%Aut.
SuperGPQA
64.8%Aut.
Terminal-Bench 2.0Stanford × Laude Institute (2026)
45.2%Aut.
Multi-SWE-Bench
42.0%Aut.
Humanity's Last Exam (with tools, text-only)
40.9%Aut.
Search
WideSearch
63.8%Aut.
Tool Calling
BFCL-V4
57.2%Aut.
Video
LiveSports-3K
77.5%Aut.
OVOBench
72.6%Aut.
VideoSimpleQA
67.8%Aut.
OVBench
65.1%Aut.
Minerva
62.4%Aut.
TOMATO
60.8%Aut.
Vision
CountBench
96.30 / 100Aut.
SimpleVQA
65.40 / 100Aut.
RefSpatialBench
56.30 / 100Aut.
ZEROBench
11.00 / 100Aut.
VLMsAreBlind
93.0%Aut.
AI2D
89.1%Aut.
VideoMME w sub.
87.8%Aut.
TempCompass
86.9%Aut.
MMStar
79.9%Aut.
MuirBench
78.7%Aut.
LongVideoBench
77.4%Aut.
BLINK
74.3%Aut.
MMMU-Pro
73.2%Aut.
MMVU
73.1%Aut.
LVBench
73.0%Aut.
TVBench
71.5%Aut.
MotionBench
70.6%Aut.
DUDE
69.4%Aut.
Hallusion Bench
63.9%Aut.
VLMsAreBiased
62.0%Aut.
EMMA
60.9%Aut.
ERQA
58.8%Aut.
OmniDocBench 1.5
10.6%Aut.
Índices de evaluación AA
(Artificial Analysis)No hay datos de evaluación AA disponibles
Puntuaciones por categoría LLM Stats
(LLM Stats (zeroeval))Code100
Image To Text65
Grounding56
Reasoning53
General39
Spatial Reasoning31
Vision7
Multimodal3
Language90
Legal80
Finance80
Healthcare80
Chat70
Knowledge70
Long Context70
Math70
Search70
Frontend Development70
3d70
Communication70
Video70
Agents60
Chemistry60
Economics60
Physics50
Tool Calling50
Science40
Coding40
Structured Output10
Precios
Precio de entrada$0 / 1M tokens
Precio de salida$0 / 1M tokens
Precio mixto (3:1)$0 / 1M tokens
Velocidad
No hay datos de velocidad disponibles
Ranking de Precios por Proveedor
Ranking de Precios por Proveedor
3 proveedores
Más barato: ByteDanceMás caro: Requesty
ProveedorEntradaSalida
1ByteDancePRINCIPAL
$0
$0
2DeepInfra
$0
$0
3Requesty
$0.25
$2
Comparar precios entre diferentes proveedores de API para este modelo.