Перейти к основному содержанию

MiMo-V2.5-Pro (Reasoning)

XiaomiОткрытые весаMIT · Коммерческое использование

Описание

MiMo-V2.5-Pro is Xiaomi's 1.02T-parameter sparse Mixture-of-Experts language model with 42B active parameters and a 1M-token context window. It inherits the MiMo-V2-Flash hybrid-attention and Multi-Token Prediction design, extends context during pre-training up to 1M tokens, and uses supervised fine-tuning, domain-specialized reinforcement learning, and Multi-Teacher On-Policy Distillation to improve complex software engineering, long-horizon agentic tasks, and ultra-long-context coherence.

Дата выхода
2026-04-22
Параметры
1.0T
Длина контекста
1.0M
Модальности
audio, text

Радар способностей

28
general
59
coding
87
reasoning
64
science
70
agents
30
multimodal

Рейтинги

Домен#МестоОценкаИсточник
Агентные возможности55
48.0
LS
Рейтинг кодинга137
76.0
AA
Общий рейтинг83
69.0
AA
Наука104
73.0
AA

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Agents

TAU3-Bench72.9%Сам.
WildClawBench43.0%Сам.
Finance Agent v241.5%

Code

FrontierSWE (Impl.)340.0%Сам.
MiMo Coding Bench73.7%Сам.
Claw-Eval64.0%Сам.

General

C-Eval91.5%Сам.
MMLU89.4%Сам.
Global-MMLU83.6%Сам.
TriviaQA81.3%Сам.
SWE-bench Verified (Agentless)35.7%Сам.

Language

MMLU-Redux92.8%Сам.
CMMLU90.2%Сам.
MMLU-Pro68.5%Сам.

Long Context

GraphWalks62.0%Сам.

Math

GSM8k99.6%Сам.
MATH86.2%Сам.
AIMEMAA37.3%Сам.

Reasoning

ARC-C97.2%Сам.
HellaSwagAI2 (2019)89.8%Сам.
BBH88.4%Сам.
DROP86.3%Сам.
Winogrande85.6%Сам.
SWE-Bench Verified78.9%Сам.
HumanEval+75.6%Сам.
MBPP+74.1%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)68.4%Сам.
GPQANYU + Cohere + Anthropic (2023)66.7%Сам.
SWE-Bench ProPrinceton NLP (2024)57.2%Сам.
LiveCodeBench v639.6%Сам.
Humanity's Last Exam34.0%Сам.

Индексы оценки AA

(Artificial Analysis)
Tau2(Sierra + U Toronto + Vector Institute (2025))
94.2
Gpqa(NYU + Cohere + Anthropic (2023))
86.6
Ifbench(Google Research (2023))
79.9
Lcr(Artificial Analysis)
79.7
Terminalbench V2 1
65.2
Coding Index(Artificial Analysis)
60.2
Scicode(UIUC + Argonne National Lab (2024))
50.6
Terminalbench Hard(Stanford × Laude Institute (2026))
43.2
Hle(Center for AI Safety + Scale AI (2025))
35.7
Intelligence Index(Artificial Analysis)
26.0
Tau Banking
9.9
Terminalbench V4 0
0.0

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Language
90
Legal
80
Math
80
Reasoning
80
Frontend Development
80
Healthcare
80
Physics
70
Finance
70
General
70
Biology
70
Chemistry
70
Code
70
Tool Calling
70
Long Context
60
Agents
60
Coding
40
Vision
30

Цены

Цена ввода$0.435 / 1M токенов
Цена вывода$0.87 / 1M токенов
Смешанная цена (3:1)$0.544 / 1M токенов
Цена чтения кэша$0.0036 / 1M токенов

Скорость

Токенов/сек0.0
Задержка первого токена0.00s
Время до первого ответа0.00s

Рейтинг цен провайдеров

Рейтинг цен провайдеров

4 провайдеров

Самый дешевый: XiaomiСамый дорогой: EmpirioLabs AI
ПровайдерВводВывод
1XiaomiСамый дешевый
$0
$0
2DeepInfra
$0
$0
3Novita
$0
$0.00001
4EmpirioLabs AI
$2.175
$4.35

Сравнение цен разных API-провайдеров для этой модели.

Внешние ссылки