Seed 1.8
ByteDanceProprietary
Description
Optimized specifically for multimodal agent scenarios. It features enhanced agent capabilities, upgraded multimodal comprehension, and more flexible context management.
Date de sortie
2026-02-17
Paramètres
—
Longueur du contexte
—
Modalités
image, text, video
Radar de capacités
39
general
100
coding
70
reasoning
51
scienceest.
50
agents
70
multimodal
Science est estimé à partir des scores scientifiques de LLM Stats ou du raisonnement lorsque les benchmarks scientifiques dédiés ne sont pas disponibles.
Classements
| Domaine | #Rang | Score | Source |
|---|---|---|---|
| Capacité agentique | 85 | 37.0 | LS |
| Classement multimodal | 91 | 48.0 | LS |
Scores de benchmarks (LLM Stats)
(LLM Stats (zeroeval))Agents
AndroidWorld
70.7%Aut.
Chat
Multi-Challenge
66.7%Aut.
Coding
AetherCode
38.2%Aut.
General
MMLU
92.3%Aut.
Language
MMLU-Pro
84.9%Aut.
Math
AIME 2025
94.3%Aut.
MathVista
87.7%Aut.
MathVision
81.3%Aut.
Beyond AIME
77.0%Aut.
DynaMath
61.5%Aut.
AMO Bench
60.0%Aut.
Multimodal
MMMU
83.4%Aut.
VideoMMMU
82.7%Aut.
OSWorld
61.9%Aut.
Physics
PHYBench
41.0%Aut.
Reasoning
LiveCodeBench Pro
1930.00 / 3000Aut.
BrowseComp-zh
81.3%Aut.
LiveCodeBench v6
79.5%Aut.
SWE-Bench Verified
72.9%Aut.
CharXiv-R
71.4%Aut.
ARC-AGI
67.9%Aut.
BrowseCompOpenAI (2025)
67.6%Aut.
SuperGPQA
64.8%Aut.
Terminal-Bench 2.0Stanford × Laude Institute (2026)
45.2%Aut.
Multi-SWE-Bench
42.0%Aut.
Humanity's Last Exam (with tools, text-only)
40.9%Aut.
Search
WideSearch
63.8%Aut.
Tool Calling
BFCL-V4
57.2%Aut.
Video
LiveSports-3K
77.5%Aut.
OVOBench
72.6%Aut.
VideoSimpleQA
67.8%Aut.
OVBench
65.1%Aut.
Minerva
62.4%Aut.
TOMATO
60.8%Aut.
Vision
CountBench
96.30 / 100Aut.
SimpleVQA
65.40 / 100Aut.
RefSpatialBench
56.30 / 100Aut.
ZEROBench
11.00 / 100Aut.
VLMsAreBlind
93.0%Aut.
AI2D
89.1%Aut.
VideoMME w sub.
87.8%Aut.
TempCompass
86.9%Aut.
MMStar
79.9%Aut.
MuirBench
78.7%Aut.
LongVideoBench
77.4%Aut.
BLINK
74.3%Aut.
MMMU-Pro
73.2%Aut.
MMVU
73.1%Aut.
LVBench
73.0%Aut.
TVBench
71.5%Aut.
MotionBench
70.6%Aut.
DUDE
69.4%Aut.
Hallusion Bench
63.9%Aut.
VLMsAreBiased
62.0%Aut.
EMMA
60.9%Aut.
ERQA
58.8%Aut.
OmniDocBench 1.5
10.6%Aut.
Indices d'évaluation AA
(Artificial Analysis)Aucune donnée d'évaluation AA disponible
Scores par catégorie LLM Stats
(LLM Stats (zeroeval))Code100
Image To Text65
Grounding56
Reasoning53
General39
Spatial Reasoning31
Vision7
Multimodal3
Language90
Legal80
Finance80
Healthcare80
Chat70
Knowledge70
Long Context70
Math70
Search70
Frontend Development70
3d70
Communication70
Video70
Agents60
Chemistry60
Economics60
Physics50
Tool Calling50
Science40
Coding40
Structured Output10
Tarification
Prix d'entrée$0 / 1M tokens
Prix de sortie$0 / 1M tokens
Prix mixte (3:1)$0 / 1M tokens
Vitesse
Aucune donnée de vitesse disponible
Classement des Prix par Fournisseur
Classement des Prix par Fournisseur
3 fournisseurs
Moins cher: ByteDancePlus cher: Requesty
FournisseurEntréeSortie
1ByteDancePRINCIPAL
$0
$0
2DeepInfra
$0
$0
3Requesty
$0.25
$2
Comparer les prix entre différents fournisseurs API pour ce modèle.