Saltar al contenido principal

Seed 1.8

ByteDanceProprietary

Descripción

Optimized specifically for multimodal agent scenarios. It features enhanced agent capabilities, upgraded multimodal comprehension, and more flexible context management.

Fecha de lanzamiento
2026-02-17
Parámetros
Longitud del contexto
Modalidades
image, text, video

Radar de capacidades

39
general
100
coding
70
reasoning
51
scienceest.
50
agents
70
multimodal

Science se estima a partir de las puntuaciones científicas de LLM Stats o del razonamiento cuando no hay benchmarks científicos dedicados.

Rankings

Dominio#PosiciónPuntuaciónFuente
Capacidad agéntica85
37.0
LS
Ranking multimodal91
48.0
LS

Puntuaciones de benchmarks (LLM Stats)

(LLM Stats (zeroeval))

Agents

AndroidWorld70.7%Aut.

Chat

Multi-Challenge66.7%Aut.

Coding

AetherCode38.2%Aut.

General

MMLU92.3%Aut.

Language

MMLU-Pro84.9%Aut.

Math

AIME 202594.3%Aut.
MathVista87.7%Aut.
MathVision81.3%Aut.
Beyond AIME77.0%Aut.
DynaMath61.5%Aut.
AMO Bench60.0%Aut.

Multimodal

MMMU83.4%Aut.
VideoMMMU82.7%Aut.
OSWorld61.9%Aut.

Physics

PHYBench41.0%Aut.

Reasoning

LiveCodeBench Pro1930.00 / 3000Aut.
BrowseComp-zh81.3%Aut.
LiveCodeBench v679.5%Aut.
SWE-Bench Verified72.9%Aut.
CharXiv-R71.4%Aut.
ARC-AGI67.9%Aut.
BrowseCompOpenAI (2025)67.6%Aut.
SuperGPQA64.8%Aut.
Terminal-Bench 2.0Stanford × Laude Institute (2026)45.2%Aut.
Multi-SWE-Bench42.0%Aut.
Humanity's Last Exam (with tools, text-only)40.9%Aut.

Search

WideSearch63.8%Aut.

Tool Calling

BFCL-V457.2%Aut.

Video

LiveSports-3K77.5%Aut.
OVOBench72.6%Aut.
VideoSimpleQA67.8%Aut.
OVBench65.1%Aut.
Minerva62.4%Aut.
TOMATO60.8%Aut.

Vision

CountBench96.30 / 100Aut.
SimpleVQA65.40 / 100Aut.
RefSpatialBench56.30 / 100Aut.
ZEROBench11.00 / 100Aut.
VLMsAreBlind93.0%Aut.
AI2D89.1%Aut.
VideoMME w sub.87.8%Aut.
TempCompass86.9%Aut.
MMStar79.9%Aut.
MuirBench78.7%Aut.
LongVideoBench77.4%Aut.
BLINK74.3%Aut.
MMMU-Pro73.2%Aut.
MMVU73.1%Aut.
LVBench73.0%Aut.
TVBench71.5%Aut.
MotionBench70.6%Aut.
DUDE69.4%Aut.
Hallusion Bench63.9%Aut.
VLMsAreBiased62.0%Aut.
EMMA60.9%Aut.
ERQA58.8%Aut.
OmniDocBench 1.510.6%Aut.

Índices de evaluación AA

(Artificial Analysis)

No hay datos de evaluación AA disponibles

Puntuaciones por categoría LLM Stats

(LLM Stats (zeroeval))
Code
100
Image To Text
65
Grounding
56
Reasoning
53
General
39
Spatial Reasoning
31
Vision
7
Multimodal
3
Language
90
Legal
80
Finance
80
Healthcare
80
Chat
70
Knowledge
70
Long Context
70
Math
70
Search
70
Frontend Development
70
3d
70
Communication
70
Video
70
Agents
60
Chemistry
60
Economics
60
Physics
50
Tool Calling
50
Science
40
Coding
40
Structured Output
10

Precios

Precio de entrada$0 / 1M tokens
Precio de salida$0 / 1M tokens
Precio mixto (3:1)$0 / 1M tokens

Velocidad

No hay datos de velocidad disponibles

Ranking de Precios por Proveedor

Ranking de Precios por Proveedor

3 proveedores

Más barato: ByteDanceMás caro: Requesty
ProveedorEntradaSalida
1ByteDancePRINCIPAL
$0
$0
2DeepInfra
$0
$0
3Requesty
$0.25
$2

Comparar precios entre diferentes proveedores de API para este modelo.

Fuentes externas