मुख्य सामग्री पर जाएं

Qwen2.5-Omni-7B

Alibaba Cloud / Qwen TeamQwenओपन वेटApache 2.0 · व्यावसायिक उपयोग

विवरण

Qwen2.5-Omni is the flagship end-to-end multimodal model in the Qwen series. It processes diverse inputs including text, images, audio, and video, delivering real-time streaming responses through text generation and natural speech synthesis using a novel Thinker-Talker architecture.

रिलीज़ तिथि
2025-03-27
पैरामीटर
7.0B
संदर्भ लंबाई
33K
मोडैलिटीज़
audio, image, text, video

क्षमता रडार

60
general
80
coding
60
reasoning
26
scienceअनुमानित
66
agents
80
multimodal

समर्पित विज्ञान बेंचमार्क उपलब्ध न होने पर Science का अनुमान LLM Stats विज्ञान स्कोर या तर्क से लगाया जाता है।

रैंकिंग

डोमेन#रैंकस्कोरस्रोत
मल्टीमॉडल रैंकिंग143
22.0
LS

बेंचमार्क स्कोर (LLM Stats)

(LLM Stats (zeroeval))

Audio

VocalSound93.9%स्वयं
GiantSteps Tempo88.0%स्वयं
MMAU Music69.2%स्वयं
MMAU Sound67.9%स्वयं
MMAU65.6%स्वयं
MMAU Speech59.8%स्वयं
CoVoST2 en-zh0.41 / 100स्वयं
MusicCaps32.8%स्वयं
Common Voice 150.08 / 100स्वयं

Chat

VoiceBench Avg74.1%स्वयं
MM-MT-Bench0.06 / 100स्वयं

General

MultiPL-E65.8%स्वयं
NMOS0.05 / 100स्वयं

Healthcare

CRPErelation76.5%स्वयं

Language

FLEURS95.9%स्वयं
MMLU-Redux71.0%स्वयं
MMLU-Pro47.0%स्वयं

Math

GSM8k88.7%स्वयं
MATH71.5%स्वयं
MathVista67.9%स्वयं
LiveBench29.6%स्वयं
MathVision25.0%स्वयं

Multimodal

MMMU59.2%स्वयं
Meld57.0%स्वयं
OmniBench56.1%स्वयं
OmniBench Music52.8%स्वयं

Reasoning

ChartQAMasry et al. (2022)85.3%स्वयं
HumanEvalOpenAI (2021)78.7%स्वयं
MBPP0.73 / 100स्वयं
GPQANYU + Cohere + Anthropic (2023)30.8%स्वयं

Vision

DocVQADocVQA (2020)95.2%स्वयं
TextVQA84.4%स्वयं
AI2D83.2%स्वयं
MMBench-V1.181.8%स्वयं
VideoMME w sub.72.4%स्वयं
RealWorldQA70.3%स्वयं
MVBench70.3%स्वयं
EgoSchema68.6%स्वयं
PointGrounding66.5%स्वयं
MMStar64.0%स्वयं
MME-RealWorld61.6%स्वयं
MuirBench59.2%स्वयं
OCRBench_V257.8%स्वयं
ODinW42.4%स्वयं
MMMU-Pro36.6%स्वयं

AA मूल्यांकन सूचकांक

(Artificial Analysis)

कोई AA मूल्यांकन डेटा उपलब्ध नहीं

LLM Stats श्रेणी स्कोर

(LLM Stats (zeroeval))
Speech To Text
90
Image To Text
80
Code
80
Language
70
Long Context
70
Reasoning
70
Safety
70
Spatial Reasoning
70
Audio
70
Video
70
Vision
70
Math
60
Multimodal
60
General
60
Legal
50
Finance
50
Healthcare
50
Chat
40
Communication
40
Physics
30
Biology
30
Chemistry
30

मूल्य निर्धारण

इनपुट मूल्य$0.1 / 1M टोकन
आउटपुट मूल्य$0.4 / 1M टोकन
मिश्रित मूल्य (3:1)$0.175 / 1M टोकन

गति

कोई गति डेटा उपलब्ध नहीं

प्रदाता मूल्य रैंकिंग

प्रदाता मूल्य रैंकिंग

3 प्रदाता

सबसे सस्ता: Alibaba (China)सबसे महंगा: Alibaba
प्रदाताइनपुटआउटपुट
1Alibaba (China)सबसे सस्ता
$0.087
$0.345
2Alibaba Cloud / Qwen Teamप्राथमिक
$0.1
$0.4
3Alibaba
$0.1
$0.4

इस मॉडल के लिए विभिन्न API प्रदाताओं के मूल्य निर्धारण की तुलना करें।

बाहरी लिंक