मुख्य सामग्री पर जाएं

Seed 1.8

ByteDanceProprietary

विवरण

Optimized specifically for multimodal agent scenarios. It features enhanced agent capabilities, upgraded multimodal comprehension, and more flexible context management.

रिलीज़ तिथि
2026-02-17
पैरामीटर
संदर्भ लंबाई
मोडैलिटीज़
image, text, video

क्षमता रडार

39
general
100
coding
70
reasoning
51
scienceअनुमानित
50
agents
70
multimodal

समर्पित विज्ञान बेंचमार्क उपलब्ध न होने पर Science का अनुमान LLM Stats विज्ञान स्कोर या तर्क से लगाया जाता है।

रैंकिंग

डोमेन#रैंकस्कोरस्रोत
एजेंटिक क्षमता85
37.0
LS
मल्टीमॉडल रैंकिंग91
48.0
LS

बेंचमार्क स्कोर (LLM Stats)

(LLM Stats (zeroeval))

Agents

AndroidWorld70.7%स्वयं

Chat

Multi-Challenge66.7%स्वयं

Coding

AetherCode38.2%स्वयं

General

MMLU92.3%स्वयं

Language

MMLU-Pro84.9%स्वयं

Math

AIME 202594.3%स्वयं
MathVista87.7%स्वयं
MathVision81.3%स्वयं
Beyond AIME77.0%स्वयं
DynaMath61.5%स्वयं
AMO Bench60.0%स्वयं

Multimodal

MMMU83.4%स्वयं
VideoMMMU82.7%स्वयं
OSWorld61.9%स्वयं

Physics

PHYBench41.0%स्वयं

Reasoning

LiveCodeBench Pro1930.00 / 3000स्वयं
BrowseComp-zh81.3%स्वयं
LiveCodeBench v679.5%स्वयं
SWE-Bench Verified72.9%स्वयं
CharXiv-R71.4%स्वयं
ARC-AGI67.9%स्वयं
BrowseCompOpenAI (2025)67.6%स्वयं
SuperGPQA64.8%स्वयं
Terminal-Bench 2.0Stanford × Laude Institute (2026)45.2%स्वयं
Multi-SWE-Bench42.0%स्वयं
Humanity's Last Exam (with tools, text-only)40.9%स्वयं

Search

WideSearch63.8%स्वयं

Tool Calling

BFCL-V457.2%स्वयं

Video

LiveSports-3K77.5%स्वयं
OVOBench72.6%स्वयं
VideoSimpleQA67.8%स्वयं
OVBench65.1%स्वयं
Minerva62.4%स्वयं
TOMATO60.8%स्वयं

Vision

CountBench96.30 / 100स्वयं
SimpleVQA65.40 / 100स्वयं
RefSpatialBench56.30 / 100स्वयं
ZEROBench11.00 / 100स्वयं
VLMsAreBlind93.0%स्वयं
AI2D89.1%स्वयं
VideoMME w sub.87.8%स्वयं
TempCompass86.9%स्वयं
MMStar79.9%स्वयं
MuirBench78.7%स्वयं
LongVideoBench77.4%स्वयं
BLINK74.3%स्वयं
MMMU-Pro73.2%स्वयं
MMVU73.1%स्वयं
LVBench73.0%स्वयं
TVBench71.5%स्वयं
MotionBench70.6%स्वयं
DUDE69.4%स्वयं
Hallusion Bench63.9%स्वयं
VLMsAreBiased62.0%स्वयं
EMMA60.9%स्वयं
ERQA58.8%स्वयं
OmniDocBench 1.510.6%स्वयं

AA मूल्यांकन सूचकांक

(Artificial Analysis)

कोई AA मूल्यांकन डेटा उपलब्ध नहीं

LLM Stats श्रेणी स्कोर

(LLM Stats (zeroeval))
Code
100
Image To Text
65
Grounding
56
Reasoning
53
General
39
Spatial Reasoning
31
Vision
7
Multimodal
3
Language
90
Legal
80
Finance
80
Healthcare
80
Chat
70
Knowledge
70
Long Context
70
Math
70
Search
70
Frontend Development
70
3d
70
Communication
70
Video
70
Agents
60
Chemistry
60
Economics
60
Physics
50
Tool Calling
50
Science
40
Coding
40
Structured Output
10

मूल्य निर्धारण

इनपुट मूल्य$0 / 1M टोकन
आउटपुट मूल्य$0 / 1M टोकन
मिश्रित मूल्य (3:1)$0 / 1M टोकन

गति

कोई गति डेटा उपलब्ध नहीं

प्रदाता मूल्य रैंकिंग

प्रदाता मूल्य रैंकिंग

3 प्रदाता

सबसे सस्ता: ByteDanceसबसे महंगा: Requesty
प्रदाताइनपुटआउटपुट
1ByteDanceप्राथमिक
$0
$0
2DeepInfra
$0
$0
3Requesty
$0.25
$2

इस मॉडल के लिए विभिन्न API प्रदाताओं के मूल्य निर्धारण की तुलना करें।

बाहरी लिंक