메인 콘텐츠로 건너뛰기

Seed 1.8

ByteDanceProprietary

설명

Optimized specifically for multimodal agent scenarios. It features enhanced agent capabilities, upgraded multimodal comprehension, and more flexible context management.

출시일
2026-02-17
파라미터
컨텍스트 길이
모달리티
image, text, video

능력 레이더

39
general
100
coding
70
reasoning
51
science추정
50
agents
70
multimodal

전용 과학 벤치마크가 없을 때 Science는 LLM Stats 과학 점수 또는 추론 능력에서 추정합니다.

랭킹

도메인#순위점수소스
에이전트형 역량85
37.0
LS
멀티모달 랭킹91
48.0
LS

벤치마크 점수 (LLM Stats)

(LLM Stats (zeroeval))

Agents

AndroidWorld70.7%자체 보고

Chat

Multi-Challenge66.7%자체 보고

Coding

AetherCode38.2%자체 보고

General

MMLU92.3%자체 보고

Language

MMLU-Pro84.9%자체 보고

Math

AIME 202594.3%자체 보고
MathVista87.7%자체 보고
MathVision81.3%자체 보고
Beyond AIME77.0%자체 보고
DynaMath61.5%자체 보고
AMO Bench60.0%자체 보고

Multimodal

MMMU83.4%자체 보고
VideoMMMU82.7%자체 보고
OSWorld61.9%자체 보고

Physics

PHYBench41.0%자체 보고

Reasoning

LiveCodeBench Pro1930.00 / 3000자체 보고
BrowseComp-zh81.3%자체 보고
LiveCodeBench v679.5%자체 보고
SWE-Bench Verified72.9%자체 보고
CharXiv-R71.4%자체 보고
ARC-AGI67.9%자체 보고
BrowseCompOpenAI (2025)67.6%자체 보고
SuperGPQA64.8%자체 보고
Terminal-Bench 2.0Stanford × Laude Institute (2026)45.2%자체 보고
Multi-SWE-Bench42.0%자체 보고
Humanity's Last Exam (with tools, text-only)40.9%자체 보고

Search

WideSearch63.8%자체 보고

Tool Calling

BFCL-V457.2%자체 보고

Video

LiveSports-3K77.5%자체 보고
OVOBench72.6%자체 보고
VideoSimpleQA67.8%자체 보고
OVBench65.1%자체 보고
Minerva62.4%자체 보고
TOMATO60.8%자체 보고

Vision

CountBench96.30 / 100자체 보고
SimpleVQA65.40 / 100자체 보고
RefSpatialBench56.30 / 100자체 보고
ZEROBench11.00 / 100자체 보고
VLMsAreBlind93.0%자체 보고
AI2D89.1%자체 보고
VideoMME w sub.87.8%자체 보고
TempCompass86.9%자체 보고
MMStar79.9%자체 보고
MuirBench78.7%자체 보고
LongVideoBench77.4%자체 보고
BLINK74.3%자체 보고
MMMU-Pro73.2%자체 보고
MMVU73.1%자체 보고
LVBench73.0%자체 보고
TVBench71.5%자체 보고
MotionBench70.6%자체 보고
DUDE69.4%자체 보고
Hallusion Bench63.9%자체 보고
VLMsAreBiased62.0%자체 보고
EMMA60.9%자체 보고
ERQA58.8%자체 보고
OmniDocBench 1.510.6%자체 보고

AA 평가 지수

(Artificial Analysis)

AA 평가 데이터가 없습니다

LLM Stats 카테고리 점수

(LLM Stats (zeroeval))
Code
100
Image To Text
65
Grounding
56
Reasoning
53
General
39
Spatial Reasoning
31
Vision
7
Multimodal
3
Language
90
Legal
80
Finance
80
Healthcare
80
Chat
70
Knowledge
70
Long Context
70
Math
70
Search
70
Frontend Development
70
3d
70
Communication
70
Video
70
Agents
60
Chemistry
60
Economics
60
Physics
50
Tool Calling
50
Science
40
Coding
40
Structured Output
10

가격

입력 가격$0 / 1M 토큰
출력 가격$0 / 1M 토큰
혼합 가격 (3:1)$0 / 1M 토큰

속도

속도 데이터가 없습니다

공급자 가격 순위

공급자 가격 순위

3개 공급자

최저가: ByteDance최고가: Requesty
공급자입력출력
1ByteDance주요
$0
$0
2DeepInfra
$0
$0
3Requesty
$0.25
$2

이 모델의 다양한 API 공급자 간 가격 비교.

외부 링크