MiMo-V2.5-Pro
Xiaomiओपन वेटMIT · व्यावसायिक उपयोग
विवरण
MiMo-V2.5-Pro is Xiaomi's 1.02T-parameter sparse Mixture-of-Experts language model with 42B active parameters and a 1M-token context window. It inherits the MiMo-V2-Flash hybrid-attention and Multi-Token Prediction design, extends context during pre-training up to 1M tokens, and uses supervised fine-tuning, domain-specialized reinforcement learning, and Multi-Teacher On-Policy Distillation to improve complex software engineering, long-horizon agentic tasks, and ultra-long-context coherence.
रिलीज़ तिथि
2026-04-22
पैरामीटर
1.0T
संदर्भ लंबाई
1.0M
मोडैलिटीज़
audio, text
क्षमता रडार
28
general
59
coding
87
reasoning
64
science
70
agents
30
multimodal
रैंकिंग
| डोमेन | #रैंक | स्कोर | स्रोत |
|---|---|---|---|
| एजेंटिक क्षमता | 55 | 48.0 | LS |
| कोडिंग रैंकिंग | 128 | 76.0 | AA |
| सामान्य रैंकिंग | 76 | 69.0 | AA |
| विज्ञान | 98 | 73.0 | AA |
बेंचमार्क स्कोर (LLM Stats)
(LLM Stats (zeroeval))Agents
TAU3-Bench
72.9%स्वयं
WildClawBench
43.0%स्वयं
Finance Agent v2
41.5%
Code
FrontierSWE (Impl.)
340.0%स्वयं
MiMo Coding Bench
73.7%स्वयं
Claw-Eval
64.0%स्वयं
General
C-Eval
91.5%स्वयं
MMLU
89.4%स्वयं
Global-MMLU
83.6%स्वयं
TriviaQA
81.3%स्वयं
SWE-bench Verified (Agentless)
35.7%स्वयं
Language
MMLU-Redux
92.8%स्वयं
CMMLU
90.2%स्वयं
MMLU-Pro
68.5%स्वयं
Long Context
GraphWalks
62.0%स्वयं
Math
GSM8k
99.6%स्वयं
MATH
86.2%स्वयं
AIMEMAA
37.3%स्वयं
Reasoning
ARC-C
97.2%स्वयं
HellaSwagAI2 (2019)
89.8%स्वयं
BBH
88.4%स्वयं
DROP
86.3%स्वयं
Winogrande
85.6%स्वयं
SWE-Bench Verified
78.9%स्वयं
HumanEval+
75.6%स्वयं
MBPP+
74.1%स्वयं
Terminal-Bench 2.0Stanford × Laude Institute (2026)
68.4%स्वयं
GPQANYU + Cohere + Anthropic (2023)
66.7%स्वयं
SWE-Bench ProPrinceton NLP (2024)
57.2%स्वयं
LiveCodeBench v6
39.6%स्वयं
Humanity's Last Exam
34.0%स्वयं
AA मूल्यांकन सूचकांक
(Artificial Analysis)Tau2(Sierra + U Toronto + Vector Institute (2025))94.2
Gpqa(NYU + Cohere + Anthropic (2023))86.6
Ifbench(Google Research (2023))79.9
Lcr(Artificial Analysis)79.7
Terminalbench V2 165.2
Coding Index(Artificial Analysis)60.2
Scicode(UIUC + Argonne National Lab (2024))50.6
Terminalbench Hard(Stanford × Laude Institute (2026))43.2
Hle(Center for AI Safety + Scale AI (2025))35.7
Intelligence Index(Artificial Analysis)26.0
Tau Banking9.9
LLM Stats श्रेणी स्कोर
(LLM Stats (zeroeval))Language90
Legal80
Math80
Reasoning80
Frontend Development80
Healthcare80
Physics70
Finance70
General70
Biology70
Chemistry70
Code70
Tool Calling70
Long Context60
Agents60
Coding40
Vision30
मूल्य निर्धारण
इनपुट मूल्य$0.435 / 1M टोकन
आउटपुट मूल्य$0.87 / 1M टोकन
मिश्रित मूल्य (3:1)$0.544 / 1M टोकन
कैश पठन मूल्य$0.0036 / 1M टोकन
गति
टोकन/सेकंड29.0
पहले टोकन में देरी2.18s
पहले उत्तर में देरी71.08s
प्रदाता मूल्य रैंकिंग
प्रदाता मूल्य रैंकिंग
4 प्रदाता
सबसे सस्ता: Xiaomiसबसे महंगा: EmpirioLabs AI
प्रदाताइनपुटआउटपुट
1Xiaomiसबसे सस्ता
$0
$0
2DeepInfra
$0
$0
3Novita
$0
$0.00001
4EmpirioLabs AI
$2.175
$4.35
इस मॉडल के लिए विभिन्न API प्रदाताओं के मूल्य निर्धारण की तुलना करें।