Перейти к основному содержанию

Seed 1.8

ByteDanceProprietary

Описание

Optimized specifically for multimodal agent scenarios. It features enhanced agent capabilities, upgraded multimodal comprehension, and more flexible context management.

Дата выхода
2026-02-17
Параметры
Длина контекста
Модальности
image, text, video

Радар способностей

39
general
100
coding
70
reasoning
51
scienceоцен.
50
agents
70
multimodal

При отсутствии специализированных научных бенчмарков Science оценивается по научным категориям LLM Stats или на основе рассуждений.

Рейтинги

Домен#МестоОценкаИсточник
Агентные возможности85
37.0
LS
Мультимодальный рейтинг91
48.0
LS

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Agents

AndroidWorld70.7%Сам.

Chat

Multi-Challenge66.7%Сам.

Coding

AetherCode38.2%Сам.

General

MMLU92.3%Сам.

Language

MMLU-Pro84.9%Сам.

Math

AIME 202594.3%Сам.
MathVista87.7%Сам.
MathVision81.3%Сам.
Beyond AIME77.0%Сам.
DynaMath61.5%Сам.
AMO Bench60.0%Сам.

Multimodal

MMMU83.4%Сам.
VideoMMMU82.7%Сам.
OSWorld61.9%Сам.

Physics

PHYBench41.0%Сам.

Reasoning

LiveCodeBench Pro1930.00 / 3000Сам.
BrowseComp-zh81.3%Сам.
LiveCodeBench v679.5%Сам.
SWE-Bench Verified72.9%Сам.
CharXiv-R71.4%Сам.
ARC-AGI67.9%Сам.
BrowseCompOpenAI (2025)67.6%Сам.
SuperGPQA64.8%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)45.2%Сам.
Multi-SWE-Bench42.0%Сам.
Humanity's Last Exam (with tools, text-only)40.9%Сам.

Search

WideSearch63.8%Сам.

Tool Calling

BFCL-V457.2%Сам.

Video

LiveSports-3K77.5%Сам.
OVOBench72.6%Сам.
VideoSimpleQA67.8%Сам.
OVBench65.1%Сам.
Minerva62.4%Сам.
TOMATO60.8%Сам.

Vision

CountBench96.30 / 100Сам.
SimpleVQA65.40 / 100Сам.
RefSpatialBench56.30 / 100Сам.
ZEROBench11.00 / 100Сам.
VLMsAreBlind93.0%Сам.
AI2D89.1%Сам.
VideoMME w sub.87.8%Сам.
TempCompass86.9%Сам.
MMStar79.9%Сам.
MuirBench78.7%Сам.
LongVideoBench77.4%Сам.
BLINK74.3%Сам.
MMMU-Pro73.2%Сам.
MMVU73.1%Сам.
LVBench73.0%Сам.
TVBench71.5%Сам.
MotionBench70.6%Сам.
DUDE69.4%Сам.
Hallusion Bench63.9%Сам.
VLMsAreBiased62.0%Сам.
EMMA60.9%Сам.
ERQA58.8%Сам.
OmniDocBench 1.510.6%Сам.

Индексы оценки AA

(Artificial Analysis)

Нет данных AA оценки

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Code
100
Image To Text
65
Grounding
56
Reasoning
53
General
39
Spatial Reasoning
31
Vision
7
Multimodal
3
Language
90
Legal
80
Finance
80
Healthcare
80
Chat
70
Knowledge
70
Long Context
70
Math
70
Search
70
Frontend Development
70
3d
70
Communication
70
Video
70
Agents
60
Chemistry
60
Economics
60
Physics
50
Tool Calling
50
Science
40
Coding
40
Structured Output
10

Цены

Цена ввода$0 / 1M токенов
Цена вывода$0 / 1M токенов
Смешанная цена (3:1)$0 / 1M токенов

Скорость

Нет данных о скорости

Рейтинг цен провайдеров

Рейтинг цен провайдеров

3 провайдеров

Самый дешевый: ByteDanceСамый дорогой: Requesty
ПровайдерВводВывод
1ByteDanceОсновной
$0
$0
2DeepInfra
$0
$0
3Requesty
$0.25
$2

Сравнение цен разных API-провайдеров для этой модели.

Внешние ссылки