Qwen2.5-Omni-7B
Alibaba Cloud / Qwen TeamQwenओपन वेटApache 2.0 · व्यावसायिक उपयोग
विवरण
Qwen2.5-Omni is the flagship end-to-end multimodal model in the Qwen series. It processes diverse inputs including text, images, audio, and video, delivering real-time streaming responses through text generation and natural speech synthesis using a novel Thinker-Talker architecture.
रिलीज़ तिथि
2025-03-27
पैरामीटर
7.0B
संदर्भ लंबाई
33K
मोडैलिटीज़
audio, image, text, video
क्षमता रडार
60
general
80
coding
60
reasoning
26
scienceअनुमानित
66
agents
80
multimodal
समर्पित विज्ञान बेंचमार्क उपलब्ध न होने पर Science का अनुमान LLM Stats विज्ञान स्कोर या तर्क से लगाया जाता है।
रैंकिंग
| डोमेन | #रैंक | स्कोर | स्रोत |
|---|---|---|---|
| मल्टीमॉडल रैंकिंग | 143 | 22.0 | LS |
बेंचमार्क स्कोर (LLM Stats)
(LLM Stats (zeroeval))Audio
VocalSound
93.9%स्वयं
GiantSteps Tempo
88.0%स्वयं
MMAU Music
69.2%स्वयं
MMAU Sound
67.9%स्वयं
MMAU
65.6%स्वयं
MMAU Speech
59.8%स्वयं
CoVoST2 en-zh
0.41 / 100स्वयं
MusicCaps
32.8%स्वयं
Common Voice 15
0.08 / 100स्वयं
Chat
VoiceBench Avg
74.1%स्वयं
MM-MT-Bench
0.06 / 100स्वयं
General
MultiPL-E
65.8%स्वयं
NMOS
0.05 / 100स्वयं
Healthcare
CRPErelation
76.5%स्वयं
Language
FLEURS
95.9%स्वयं
MMLU-Redux
71.0%स्वयं
MMLU-Pro
47.0%स्वयं
Math
GSM8k
88.7%स्वयं
MATH
71.5%स्वयं
MathVista
67.9%स्वयं
LiveBench
29.6%स्वयं
MathVision
25.0%स्वयं
Multimodal
MMMU
59.2%स्वयं
Meld
57.0%स्वयं
OmniBench
56.1%स्वयं
OmniBench Music
52.8%स्वयं
Reasoning
ChartQAMasry et al. (2022)
85.3%स्वयं
HumanEvalOpenAI (2021)
78.7%स्वयं
MBPP
0.73 / 100स्वयं
GPQANYU + Cohere + Anthropic (2023)
30.8%स्वयं
Vision
DocVQADocVQA (2020)
95.2%स्वयं
TextVQA
84.4%स्वयं
AI2D
83.2%स्वयं
MMBench-V1.1
81.8%स्वयं
VideoMME w sub.
72.4%स्वयं
RealWorldQA
70.3%स्वयं
MVBench
70.3%स्वयं
EgoSchema
68.6%स्वयं
PointGrounding
66.5%स्वयं
MMStar
64.0%स्वयं
MME-RealWorld
61.6%स्वयं
MuirBench
59.2%स्वयं
OCRBench_V2
57.8%स्वयं
ODinW
42.4%स्वयं
MMMU-Pro
36.6%स्वयं
AA मूल्यांकन सूचकांक
(Artificial Analysis)कोई AA मूल्यांकन डेटा उपलब्ध नहीं
LLM Stats श्रेणी स्कोर
(LLM Stats (zeroeval))Speech To Text90
Image To Text80
Code80
Language70
Long Context70
Reasoning70
Safety70
Spatial Reasoning70
Audio70
Video70
Vision70
Math60
Multimodal60
General60
Legal50
Finance50
Healthcare50
Chat40
Communication40
Physics30
Biology30
Chemistry30
मूल्य निर्धारण
इनपुट मूल्य$0.1 / 1M टोकन
आउटपुट मूल्य$0.4 / 1M टोकन
मिश्रित मूल्य (3:1)$0.175 / 1M टोकन
गति
कोई गति डेटा उपलब्ध नहीं
प्रदाता मूल्य रैंकिंग
प्रदाता मूल्य रैंकिंग
3 प्रदाता
सबसे सस्ता: Alibaba (China)सबसे महंगा: Alibaba
प्रदाताइनपुटआउटपुट
1Alibaba (China)सबसे सस्ता
$0.087
$0.345
2Alibaba Cloud / Qwen Teamप्राथमिक
$0.1
$0.4
3Alibaba
$0.1
$0.4
इस मॉडल के लिए विभिन्न API प्रदाताओं के मूल्य निर्धारण की तुलना करें।