Passer au contenu principal

Seed 1.8

ByteDanceProprietary

Description

Optimized specifically for multimodal agent scenarios. It features enhanced agent capabilities, upgraded multimodal comprehension, and more flexible context management.

Date de sortie
2026-02-17
Paramètres
Longueur du contexte
Modalités
image, text, video

Radar de capacités

39
general
100
coding
70
reasoning
51
scienceest.
50
agents
70
multimodal

Science est estimé à partir des scores scientifiques de LLM Stats ou du raisonnement lorsque les benchmarks scientifiques dédiés ne sont pas disponibles.

Classements

Domaine#RangScoreSource
Capacité agentique85
37.0
LS
Classement multimodal91
48.0
LS

Scores de benchmarks (LLM Stats)

(LLM Stats (zeroeval))

Agents

AndroidWorld70.7%Aut.

Chat

Multi-Challenge66.7%Aut.

Coding

AetherCode38.2%Aut.

General

MMLU92.3%Aut.

Language

MMLU-Pro84.9%Aut.

Math

AIME 202594.3%Aut.
MathVista87.7%Aut.
MathVision81.3%Aut.
Beyond AIME77.0%Aut.
DynaMath61.5%Aut.
AMO Bench60.0%Aut.

Multimodal

MMMU83.4%Aut.
VideoMMMU82.7%Aut.
OSWorld61.9%Aut.

Physics

PHYBench41.0%Aut.

Reasoning

LiveCodeBench Pro1930.00 / 3000Aut.
BrowseComp-zh81.3%Aut.
LiveCodeBench v679.5%Aut.
SWE-Bench Verified72.9%Aut.
CharXiv-R71.4%Aut.
ARC-AGI67.9%Aut.
BrowseCompOpenAI (2025)67.6%Aut.
SuperGPQA64.8%Aut.
Terminal-Bench 2.0Stanford × Laude Institute (2026)45.2%Aut.
Multi-SWE-Bench42.0%Aut.
Humanity's Last Exam (with tools, text-only)40.9%Aut.

Search

WideSearch63.8%Aut.

Tool Calling

BFCL-V457.2%Aut.

Video

LiveSports-3K77.5%Aut.
OVOBench72.6%Aut.
VideoSimpleQA67.8%Aut.
OVBench65.1%Aut.
Minerva62.4%Aut.
TOMATO60.8%Aut.

Vision

CountBench96.30 / 100Aut.
SimpleVQA65.40 / 100Aut.
RefSpatialBench56.30 / 100Aut.
ZEROBench11.00 / 100Aut.
VLMsAreBlind93.0%Aut.
AI2D89.1%Aut.
VideoMME w sub.87.8%Aut.
TempCompass86.9%Aut.
MMStar79.9%Aut.
MuirBench78.7%Aut.
LongVideoBench77.4%Aut.
BLINK74.3%Aut.
MMMU-Pro73.2%Aut.
MMVU73.1%Aut.
LVBench73.0%Aut.
TVBench71.5%Aut.
MotionBench70.6%Aut.
DUDE69.4%Aut.
Hallusion Bench63.9%Aut.
VLMsAreBiased62.0%Aut.
EMMA60.9%Aut.
ERQA58.8%Aut.
OmniDocBench 1.510.6%Aut.

Indices d'évaluation AA

(Artificial Analysis)

Aucune donnée d'évaluation AA disponible

Scores par catégorie LLM Stats

(LLM Stats (zeroeval))
Code
100
Image To Text
65
Grounding
56
Reasoning
53
General
39
Spatial Reasoning
31
Vision
7
Multimodal
3
Language
90
Legal
80
Finance
80
Healthcare
80
Chat
70
Knowledge
70
Long Context
70
Math
70
Search
70
Frontend Development
70
3d
70
Communication
70
Video
70
Agents
60
Chemistry
60
Economics
60
Physics
50
Tool Calling
50
Science
40
Coding
40
Structured Output
10

Tarification

Prix d'entrée$0 / 1M tokens
Prix de sortie$0 / 1M tokens
Prix mixte (3:1)$0 / 1M tokens

Vitesse

Aucune donnée de vitesse disponible

Classement des Prix par Fournisseur

Classement des Prix par Fournisseur

3 fournisseurs

Moins cher: ByteDancePlus cher: Requesty
FournisseurEntréeSortie
1ByteDancePRINCIPAL
$0
$0
2DeepInfra
$0
$0
3Requesty
$0.25
$2

Comparer les prix entre différents fournisseurs API pour ce modèle.

Sources externes