MiMo-V2.5-Pro
XiaomiОткрытые весаMIT · Коммерческое использование
Описание
MiMo-V2.5-Pro is Xiaomi's 1.02T-parameter sparse Mixture-of-Experts language model with 42B active parameters and a 1M-token context window. It inherits the MiMo-V2-Flash hybrid-attention and Multi-Token Prediction design, extends context during pre-training up to 1M tokens, and uses supervised fine-tuning, domain-specialized reinforcement learning, and Multi-Teacher On-Policy Distillation to improve complex software engineering, long-horizon agentic tasks, and ultra-long-context coherence.
Дата выхода
2026-04-22
Параметры
1.0T
Длина контекста
1.0M
Модальности
text
Радар способностей
41
general
59
coding
87
reasoning
64
science
70
agents
0
multimodal
Рейтинги
| Домен | #Место | Оценка | Источник |
|---|---|---|---|
| Агентные возможности | 52 | 52.0 | LS |
| Рейтинг кодинга | 64 | 78.0 | AA |
| Общий рейтинг | 41 | 81.0 | AA |
| Наука | 56 | 79.0 | AA |
Оценки бенчмарков (LLM Stats)
(LLM Stats (zeroeval))Agents
FrontierSWE (Impl.)
340.0%Сам.
MiMo Coding Bench
73.7%Сам.
TAU3-Bench
72.9%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)
68.4%Сам.
Claw-Eval
64.0%Сам.
SWE-Bench ProPrinceton NLP (2024)
57.2%Сам.
WildClawBench
43.0%Сам.
Finance Agent v2
41.5%
Biology
GPQANYU + Cohere + Anthropic (2023)
66.7%Сам.
Code
SWE-Bench Verified
78.9%Сам.
Finance
MMLU
89.4%Сам.
MMLU-Pro
68.5%Сам.
General
ARC-C
97.2%Сам.
MMLU-Redux
92.8%Сам.
C-Eval
91.5%Сам.
CMMLU
90.2%Сам.
Global-MMLU
83.6%Сам.
TriviaQA
81.3%Сам.
MBPP+
74.1%Сам.
LiveCodeBench v6
39.6%Сам.
SWE-bench Verified (Agentless)
35.7%Сам.
Language
BBH
88.4%Сам.
Winogrande
85.6%Сам.
Long Context
GraphWalks
62.0%Сам.
Math
GSM8k
99.6%Сам.
DROP
86.3%Сам.
MATH
86.2%Сам.
AIMEMAA
37.3%Сам.
Humanity's Last Exam
34.0%Сам.
Reasoning
HellaSwagAI2 (2019)
89.8%Сам.
HumanEval+
75.6%Сам.
Индексы оценки AA
(Artificial Analysis)Coding Index(Artificial Analysis)60.2
Intelligence Index(Artificial Analysis)42.9
Tau2(Sierra + U Toronto + Vector Institute (2025))0.9
Gpqa(NYU + Cohere + Anthropic (2023))0.9
Ifbench(Google Research (2023))0.8
Lcr(Artificial Analysis)0.8
Terminalbench V2 10.7
Scicode(UIUC + Argonne National Lab (2024))0.5
Terminalbench Hard(Stanford × Laude Institute (2026))0.4
Hle(Center for AI Safety + Scale AI (2025))0.4
Tau Banking0.1
Оценки категорий LLM Stats
(LLM Stats (zeroeval))Language90
Legal80
Math80
Reasoning80
Frontend Development80
Healthcare80
Physics70
Finance70
General70
Biology70
Chemistry70
Code70
Tool Calling70
Long Context60
Agents60
Coding40
Vision30
Цены
Цена ввода$0.435 / 1M токенов
Цена вывода$0.87 / 1M токенов
Смешанная цена (3:1)$0.544 / 1M токенов
Цена чтения кэша$0.0036 / 1M токенов
Скорость
Токенов/сек48.1
Задержка первого токена2.82s
Время до первого ответа44.40s
Рейтинг цен провайдеров
Рейтинг цен провайдеров
8 провайдеров
Самый дешевый: XiaomiСамый дорогой: EmpirioLabs AI
ПровайдерВводВывод
1XiaomiСамый дешевый
$0
$0
2DeepInfra
$0
$0
3Novita
$0
$0.00001
4DigitalOcean
$0.4
$1.5
5CrofAI
$0.4
$0.8
6OpenCode Go
$0.435
$0.87
7LLM Gateway
$0.435
$0.87
8EmpirioLabs AI
$2.175
$4.35
Сравнение цен разных API-провайдеров для этой модели.