メインコンテンツへスキップ

MiMo-V2.5-Pro

XiaomiオープンウエイトMIT · 商用利用可

説明

MiMo-V2.5-Pro is Xiaomi's 1.02T-parameter sparse Mixture-of-Experts language model with 42B active parameters and a 1M-token context window. It inherits the MiMo-V2-Flash hybrid-attention and Multi-Token Prediction design, extends context during pre-training up to 1M tokens, and uses supervised fine-tuning, domain-specialized reinforcement learning, and Multi-Teacher On-Policy Distillation to improve complex software engineering, long-horizon agentic tasks, and ultra-long-context coherence.

リリース日
2026-04-22
パラメータ
1.0T
コンテキスト長
1.0M
モダリティ
text

能力レーダー

41
general
59
coding
87
reasoning
64
science
70
agents
0
multimodal

ランキング

ドメイン#順位スコアソース
エージェント能力52
52.0
LS
コーディングランキング64
78.0
AA
総合ランキング41
81.0
AA
科学56
79.0
AA

ベンチマークスコア (LLM Stats)

(LLM Stats (zeroeval))

Agents

FrontierSWE (Impl.)340.0%自己申告
MiMo Coding Bench73.7%自己申告
TAU3-Bench72.9%自己申告
Terminal-Bench 2.0Stanford × Laude Institute (2026)68.4%自己申告
Claw-Eval64.0%自己申告
SWE-Bench ProPrinceton NLP (2024)57.2%自己申告
WildClawBench43.0%自己申告
Finance Agent v241.5%

Biology

GPQANYU + Cohere + Anthropic (2023)66.7%自己申告

Code

SWE-Bench Verified78.9%自己申告

Finance

MMLU89.4%自己申告
MMLU-Pro68.5%自己申告

General

ARC-C97.2%自己申告
MMLU-Redux92.8%自己申告
C-Eval91.5%自己申告
CMMLU90.2%自己申告
Global-MMLU83.6%自己申告
TriviaQA81.3%自己申告
MBPP+74.1%自己申告
LiveCodeBench v639.6%自己申告
SWE-bench Verified (Agentless)35.7%自己申告

Language

BBH88.4%自己申告
Winogrande85.6%自己申告

Long Context

GraphWalks62.0%自己申告

Math

GSM8k99.6%自己申告
DROP86.3%自己申告
MATH86.2%自己申告
AIMEMAA37.3%自己申告
Humanity's Last Exam34.0%自己申告

Reasoning

HellaSwagAI2 (2019)89.8%自己申告
HumanEval+75.6%自己申告

AA評価指数

(Artificial Analysis)
Coding Index(Artificial Analysis)
60.2
Intelligence Index(Artificial Analysis)
42.9
Tau2(Sierra + U Toronto + Vector Institute (2025))
0.9
Gpqa(NYU + Cohere + Anthropic (2023))
0.9
Ifbench(Google Research (2023))
0.8
Lcr(Artificial Analysis)
0.8
Terminalbench V2 1
0.7
Scicode(UIUC + Argonne National Lab (2024))
0.5
Terminalbench Hard(Stanford × Laude Institute (2026))
0.4
Hle(Center for AI Safety + Scale AI (2025))
0.4
Tau Banking
0.1

LLM Statsカテゴリスコア

(LLM Stats (zeroeval))
Language
90
Legal
80
Math
80
Reasoning
80
Frontend Development
80
Healthcare
80
Physics
70
Finance
70
General
70
Biology
70
Chemistry
70
Code
70
Tool Calling
70
Long Context
60
Agents
60
Coding
40
Vision
30

価格設定

入力価格$0.435 / 1Mトークン
出力価格$0.87 / 1Mトークン
混合価格(3:1)$0.544 / 1Mトークン
キャッシュ読み取り価格$0.0036 / 1Mトークン

速度

トークン/秒48.1
初トークン遅延2.82s
初回答遅延44.40s

プロバイダー価格ランキング

プロバイダー価格ランキング

8 プロバイダー

最安: Xiaomi最高: EmpirioLabs AI
プロバイダー入力出力
1Xiaomi最安
$0
$0
2DeepInfra
$0
$0
3Novita
$0
$0.00001
4DigitalOcean
$0.4
$1.5
5CrofAI
$0.4
$0.8
6OpenCode Go
$0.435
$0.87
7LLM Gateway
$0.435
$0.87
8EmpirioLabs AI
$2.175
$4.35

このモデルの異なるAPIプロバイダー間の価格を比較。

外部リンク