मुख्य सामग्री पर जाएं

Qwen2.5 VL 7B Instruct

Alibaba Cloud / Qwen TeamQwenओपन वेटApache 2.0 · व्यावसायिक उपयोग

विवरण

Qwen2.5-VL is a vision-language model from the Qwen family. Key enhancements include visual understanding (objects, text, charts, layouts), visual agent capabilities (tool use, computer/phone control), long video comprehension with event pinpointing, visual localization (bounding boxes/points), and structured output generation.

रिलीज़ तिथि
2025-01-26
पैरामीटर
8.3B
संदर्भ लंबाई
131K
मोडैलिटीज़
image, text

क्षमता रडार

60
general
0
coding
50
reasoning
51
scienceअनुमानित
50
agents
90
multimodal

समर्पित विज्ञान बेंचमार्क उपलब्ध न होने पर Science का अनुमान LLM Stats विज्ञान स्कोर या तर्क से लगाया जाता है।

रैंकिंग

डोमेन#रैंकस्कोरस्रोत
एजेंटिक क्षमता104
39.0
LS
मल्टीमॉडल रैंकिंग80
28.0
LS

बेंचमार्क स्कोर (LLM Stats)

(LLM Stats (zeroeval))

Agents

MobileMiniWob++_SR91.4%स्वयं
AITZ_EM81.9%स्वयं
AndroidWorld_SR25.5%स्वयं

General

MMVet67.1%स्वयं
MMStar63.9%स्वयं
MMT-Bench63.6%स्वयं
MMMU58.6%स्वयं
MMMU-Pro38.3%स्वयं

Grounding

ScreenSpot84.7%स्वयं
ScreenSpot Pro29.0%स्वयं

Image To Text

DocVQADocVQA (2020)95.7%स्वयं
OCRBench86.4%स्वयं
TextVQA84.9%स्वयं

Language

CharadesSTA43.6%स्वयं

Long Context

MLVU70.2%स्वयं
LongVideoBench54.7%स्वयं
LVBench45.3%स्वयं

Math

MathVista-Mini68.2%स्वयं
MathVision25.1%स्वयं

Multimodal

Android Control Low_EM91.4%स्वयं
ChartQAMasry et al. (2022)87.3%स्वयं
MMBench84.3%स्वयं
InfoVQA82.6%स्वयं
CC-OCR77.8%स्वयं
TempCompass71.7%स्वयं
VideoMME w sub.71.6%स्वयं
PerceptionTest70.5%स्वयं
MVBench69.6%स्वयं
VideoMME w/o sub.65.1%स्वयं
Android Control High_EM60.1%स्वयं
MMBench-Video1.8%स्वयं

Reasoning

Hallusion Bench52.9%स्वयं

AA मूल्यांकन सूचकांक

(Artificial Analysis)

कोई AA मूल्यांकन डेटा उपलब्ध नहीं

LLM Stats श्रेणी स्कोर

(LLM Stats (zeroeval))
Image To Text
90
Structured Output
80
Text-to-image
80
Long Context
60
Multimodal
60
Reasoning
60
Spatial Reasoning
60
General
60
Grounding
60
Healthcare
60
Vision
60
Math
50
Agents
50
Video
50
Language
40

मूल्य निर्धारण

इनपुट मूल्य$0.35 / 1M टोकन
आउटपुट मूल्य$1.05 / 1M टोकन
मिश्रित मूल्य (3:1)$0.525 / 1M टोकन

गति

कोई गति डेटा उपलब्ध नहीं

प्रदाता मूल्य रैंकिंग

प्रदाता मूल्य रैंकिंग

3 प्रदाता

सबसे सस्ता: Alibaba (China)सबसे महंगा: Alibaba
प्रदाताइनपुटआउटपुट
1Alibaba (China)सबसे सस्ता
$0.287
$0.717
2Alibaba Cloud / Qwen Teamप्राथमिक
$0.35
$1.05
3Alibaba
$0.35
$1.05

इस मॉडल के लिए विभिन्न API प्रदाताओं के मूल्य निर्धारण की तुलना करें।

बाहरी लिंक