メインコンテンツへスキップ

MiMo-V2.5-Pro

XiaomiオープンウエイトMIT · 商用利用可

説明

MiMo-V2.5-Pro is Xiaomi's 1.02T-parameter sparse Mixture-of-Experts language model with 42B active parameters and a 1M-token context window. It inherits the MiMo-V2-Flash hybrid-attention and Multi-Token Prediction design, extends context during pre-training up to 1M tokens, and uses supervised fine-tuning, domain-specialized reinforcement learning, and Multi-Teacher On-Policy Distillation to improve complex software engineering, long-horizon agentic tasks, and ultra-long-context coherence.

リリース日
2026-04-22
パラメータ
1.0T
コンテキスト長
1.0M
モダリティ
audio, text

能力レーダー

28
general
59
coding
87
reasoning
64
science
70
agents
30
multimodal

ランキング

ドメイン#順位スコアソース
エージェント能力55
48.0
LS
コーディングランキング128
76.0
AA
総合ランキング76
69.0
AA
科学98
73.0
AA

ベンチマークスコア (LLM Stats)

(LLM Stats (zeroeval))

Agents

TAU3-Bench72.9%自己申告
WildClawBench43.0%自己申告
Finance Agent v241.5%

Code

FrontierSWE (Impl.)340.0%自己申告
MiMo Coding Bench73.7%自己申告
Claw-Eval64.0%自己申告

General

C-Eval91.5%自己申告
MMLU89.4%自己申告
Global-MMLU83.6%自己申告
TriviaQA81.3%自己申告
SWE-bench Verified (Agentless)35.7%自己申告

Language

MMLU-Redux92.8%自己申告
CMMLU90.2%自己申告
MMLU-Pro68.5%自己申告

Long Context

GraphWalks62.0%自己申告

Math

GSM8k99.6%自己申告
MATH86.2%自己申告
AIMEMAA37.3%自己申告

Reasoning

ARC-C97.2%自己申告
HellaSwagAI2 (2019)89.8%自己申告
BBH88.4%自己申告
DROP86.3%自己申告
Winogrande85.6%自己申告
SWE-Bench Verified78.9%自己申告
HumanEval+75.6%自己申告
MBPP+74.1%自己申告
Terminal-Bench 2.0Stanford × Laude Institute (2026)68.4%自己申告
GPQANYU + Cohere + Anthropic (2023)66.7%自己申告
SWE-Bench ProPrinceton NLP (2024)57.2%自己申告
LiveCodeBench v639.6%自己申告
Humanity's Last Exam34.0%自己申告

AA評価指数

(Artificial Analysis)
Tau2(Sierra + U Toronto + Vector Institute (2025))
94.2
Gpqa(NYU + Cohere + Anthropic (2023))
86.6
Ifbench(Google Research (2023))
79.9
Lcr(Artificial Analysis)
79.7
Terminalbench V2 1
65.2
Coding Index(Artificial Analysis)
60.2
Scicode(UIUC + Argonne National Lab (2024))
50.6
Terminalbench Hard(Stanford × Laude Institute (2026))
43.2
Hle(Center for AI Safety + Scale AI (2025))
35.7
Intelligence Index(Artificial Analysis)
26.0
Tau Banking
9.9

LLM Statsカテゴリスコア

(LLM Stats (zeroeval))
Language
90
Legal
80
Math
80
Reasoning
80
Frontend Development
80
Healthcare
80
Physics
70
Finance
70
General
70
Biology
70
Chemistry
70
Code
70
Tool Calling
70
Long Context
60
Agents
60
Coding
40
Vision
30

価格設定

入力価格$0.435 / 1Mトークン
出力価格$0.87 / 1Mトークン
混合価格(3:1)$0.544 / 1Mトークン
キャッシュ読み取り価格$0.0036 / 1Mトークン

速度

トークン/秒29.2
初トークン遅延2.10s
初回答遅延70.53s

プロバイダー価格ランキング

プロバイダー価格ランキング

4 プロバイダー

最安: Xiaomi最高: EmpirioLabs AI
プロバイダー入力出力
1Xiaomi最安
$0
$0
2DeepInfra
$0
$0
3Novita
$0
$0.00001
4EmpirioLabs AI
$2.175
$4.35

このモデルの異なるAPIプロバイダー間の価格を比較。

外部リンク