Seed 1.8
ByteDanceProprietary
Описание
Optimized specifically for multimodal agent scenarios. It features enhanced agent capabilities, upgraded multimodal comprehension, and more flexible context management.
Дата выхода
2026-02-17
Параметры
—
Длина контекста
—
Модальности
image, text, video
Радар способностей
39
general
100
coding
70
reasoning
51
scienceоцен.
50
agents
70
multimodal
При отсутствии специализированных научных бенчмарков Science оценивается по научным категориям LLM Stats или на основе рассуждений.
Рейтинги
| Домен | #Место | Оценка | Источник |
|---|---|---|---|
| Агентные возможности | 85 | 37.0 | LS |
| Мультимодальный рейтинг | 91 | 48.0 | LS |
Оценки бенчмарков (LLM Stats)
(LLM Stats (zeroeval))Agents
AndroidWorld
70.7%Сам.
Chat
Multi-Challenge
66.7%Сам.
Coding
AetherCode
38.2%Сам.
General
MMLU
92.3%Сам.
Language
MMLU-Pro
84.9%Сам.
Math
AIME 2025
94.3%Сам.
MathVista
87.7%Сам.
MathVision
81.3%Сам.
Beyond AIME
77.0%Сам.
DynaMath
61.5%Сам.
AMO Bench
60.0%Сам.
Multimodal
MMMU
83.4%Сам.
VideoMMMU
82.7%Сам.
OSWorld
61.9%Сам.
Physics
PHYBench
41.0%Сам.
Reasoning
LiveCodeBench Pro
1930.00 / 3000Сам.
BrowseComp-zh
81.3%Сам.
LiveCodeBench v6
79.5%Сам.
SWE-Bench Verified
72.9%Сам.
CharXiv-R
71.4%Сам.
ARC-AGI
67.9%Сам.
BrowseCompOpenAI (2025)
67.6%Сам.
SuperGPQA
64.8%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)
45.2%Сам.
Multi-SWE-Bench
42.0%Сам.
Humanity's Last Exam (with tools, text-only)
40.9%Сам.
Search
WideSearch
63.8%Сам.
Tool Calling
BFCL-V4
57.2%Сам.
Video
LiveSports-3K
77.5%Сам.
OVOBench
72.6%Сам.
VideoSimpleQA
67.8%Сам.
OVBench
65.1%Сам.
Minerva
62.4%Сам.
TOMATO
60.8%Сам.
Vision
CountBench
96.30 / 100Сам.
SimpleVQA
65.40 / 100Сам.
RefSpatialBench
56.30 / 100Сам.
ZEROBench
11.00 / 100Сам.
VLMsAreBlind
93.0%Сам.
AI2D
89.1%Сам.
VideoMME w sub.
87.8%Сам.
TempCompass
86.9%Сам.
MMStar
79.9%Сам.
MuirBench
78.7%Сам.
LongVideoBench
77.4%Сам.
BLINK
74.3%Сам.
MMMU-Pro
73.2%Сам.
MMVU
73.1%Сам.
LVBench
73.0%Сам.
TVBench
71.5%Сам.
MotionBench
70.6%Сам.
DUDE
69.4%Сам.
Hallusion Bench
63.9%Сам.
VLMsAreBiased
62.0%Сам.
EMMA
60.9%Сам.
ERQA
58.8%Сам.
OmniDocBench 1.5
10.6%Сам.
Индексы оценки AA
(Artificial Analysis)Нет данных AA оценки
Оценки категорий LLM Stats
(LLM Stats (zeroeval))Code100
Image To Text65
Grounding56
Reasoning53
General39
Spatial Reasoning31
Vision7
Multimodal3
Language90
Legal80
Finance80
Healthcare80
Chat70
Knowledge70
Long Context70
Math70
Search70
Frontend Development70
3d70
Communication70
Video70
Agents60
Chemistry60
Economics60
Physics50
Tool Calling50
Science40
Coding40
Structured Output10
Цены
Цена ввода$0 / 1M токенов
Цена вывода$0 / 1M токенов
Смешанная цена (3:1)$0 / 1M токенов
Скорость
Нет данных о скорости
Рейтинг цен провайдеров
Рейтинг цен провайдеров
3 провайдеров
Самый дешевый: ByteDanceСамый дорогой: Requesty
ПровайдерВводВывод
1ByteDanceОсновной
$0
$0
2DeepInfra
$0
$0
3Requesty
$0.25
$2
Сравнение цен разных API-провайдеров для этой модели.