Qwen2.5-Omni-7B
Alibaba Cloud / Qwen TeamQwenОткрытые весаApache 2.0 · Коммерческое использование
Описание
Qwen2.5-Omni is the flagship end-to-end multimodal model in the Qwen series. It processes diverse inputs including text, images, audio, and video, delivering real-time streaming responses through text generation and natural speech synthesis using a novel Thinker-Talker architecture.
Дата выхода
2025-03-27
Параметры
7.0B
Длина контекста
33K
Модальности
audio, image, text, video
Радар способностей
60
general
80
coding
60
reasoning
26
scienceоцен.
66
agents
80
multimodal
При отсутствии специализированных научных бенчмарков Science оценивается по научным категориям LLM Stats или на основе рассуждений.
Рейтинги
| Домен | #Место | Оценка | Источник |
|---|---|---|---|
| Мультимодальный рейтинг | 83 | 25.0 | LS |
Оценки бенчмарков (LLM Stats)
(LLM Stats (zeroeval))Audio
VocalSound
93.9%Сам.
GiantSteps Tempo
88.0%Сам.
MMAU Music
69.2%Сам.
MMAU Sound
67.9%Сам.
MMAU
65.6%Сам.
MMAU Speech
59.8%Сам.
OmniBench Music
52.8%Сам.
CoVoST2 en-zh
0.41 / 100Сам.
MusicCaps
32.8%Сам.
Common Voice 15
0.08 / 100Сам.
Biology
GPQANYU + Cohere + Anthropic (2023)
30.8%Сам.
Code
HumanEvalOpenAI (2021)
78.7%Сам.
Communication
VoiceBench Avg
74.1%Сам.
MM-MT-Bench
0.06 / 100Сам.
Creativity
Meld
57.0%Сам.
Finance
MMLU-Pro
47.0%Сам.
General
MBPP
0.73 / 100Сам.
MMLU-Redux
71.0%Сам.
MultiPL-E
65.8%Сам.
MMStar
64.0%Сам.
MME-RealWorld
61.6%Сам.
MMMU
59.2%Сам.
MMMU-Pro
36.6%Сам.
LiveBench
29.6%Сам.
NMOS
0.05 / 100Сам.
Grounding
PointGrounding
66.5%Сам.
Healthcare
CRPErelation
76.5%Сам.
Image To Text
DocVQADocVQA (2020)
95.2%Сам.
TextVQA
84.4%Сам.
OCRBench_V2
57.8%Сам.
Language
FLEURS
95.9%Сам.
Long Context
EgoSchema
68.6%Сам.
Math
GSM8k
88.7%Сам.
MATH
71.5%Сам.
MathVista
67.9%Сам.
MathVision
25.0%Сам.
Multimodal
ChartQAMasry et al. (2022)
85.3%Сам.
AI2D
83.2%Сам.
MMBench-V1.1
81.8%Сам.
VideoMME w sub.
72.4%Сам.
MVBench
70.3%Сам.
MuirBench
59.2%Сам.
OmniBench
56.1%Сам.
Spatial Reasoning
RealWorldQA
70.3%Сам.
Vision
ODinW
42.4%Сам.
Индексы оценки AA
(Artificial Analysis)Нет данных AA оценки
Оценки категорий LLM Stats
(LLM Stats (zeroeval))Speech To Text100
Image To Text80
Code80
Long Context70
Spatial Reasoning70
Language70
Audio70
Video70
Vision70
Math60
Multimodal60
Reasoning60
General60
Legal50
Finance50
Healthcare50
Physics30
Biology30
Chemistry30
Communication10
Цены
Цена ввода$0.1 / 1M токенов
Цена вывода$0.4 / 1M токенов
Смешанная цена (3:1)$0.175 / 1M токенов
Скорость
Нет данных о скорости
Рейтинг цен провайдеров
Рейтинг цен провайдеров
3 провайдеров
Самый дешевый: Alibaba (China)Самый дорогой: Alibaba
ПровайдерВводВывод
1Alibaba (China)Самый дешевый
$0.087
$0.345
2Alibaba Cloud / Qwen TeamОсновной
$0.1
$0.4
3Alibaba
$0.1
$0.4
Сравнение цен разных API-провайдеров для этой модели.