Перейти к основному содержанию

MiMo-V2.5-Pro

XiaomiОткрытые весаMIT · Коммерческое использование

Описание

MiMo-V2.5-Pro is Xiaomi's 1.02T-parameter sparse Mixture-of-Experts language model with 42B active parameters and a 1M-token context window. It inherits the MiMo-V2-Flash hybrid-attention and Multi-Token Prediction design, extends context during pre-training up to 1M tokens, and uses supervised fine-tuning, domain-specialized reinforcement learning, and Multi-Teacher On-Policy Distillation to improve complex software engineering, long-horizon agentic tasks, and ultra-long-context coherence.

Дата выхода
2026-04-22
Параметры
1.0T
Длина контекста
1.0M
Модальности
text

Радар способностей

41
general
59
coding
87
reasoning
64
science
70
agents
0
multimodal

Рейтинги

Домен#МестоОценкаИсточник
Агентные возможности52
52.0
LS
Рейтинг кодинга64
78.0
AA
Общий рейтинг41
81.0
AA
Наука56
79.0
AA

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Agents

FrontierSWE (Impl.)340.0%Сам.
MiMo Coding Bench73.7%Сам.
TAU3-Bench72.9%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)68.4%Сам.
Claw-Eval64.0%Сам.
SWE-Bench ProPrinceton NLP (2024)57.2%Сам.
WildClawBench43.0%Сам.
Finance Agent v241.5%

Biology

GPQANYU + Cohere + Anthropic (2023)66.7%Сам.

Code

SWE-Bench Verified78.9%Сам.

Finance

MMLU89.4%Сам.
MMLU-Pro68.5%Сам.

General

ARC-C97.2%Сам.
MMLU-Redux92.8%Сам.
C-Eval91.5%Сам.
CMMLU90.2%Сам.
Global-MMLU83.6%Сам.
TriviaQA81.3%Сам.
MBPP+74.1%Сам.
LiveCodeBench v639.6%Сам.
SWE-bench Verified (Agentless)35.7%Сам.

Language

BBH88.4%Сам.
Winogrande85.6%Сам.

Long Context

GraphWalks62.0%Сам.

Math

GSM8k99.6%Сам.
DROP86.3%Сам.
MATH86.2%Сам.
AIMEMAA37.3%Сам.
Humanity's Last Exam34.0%Сам.

Reasoning

HellaSwagAI2 (2019)89.8%Сам.
HumanEval+75.6%Сам.

Индексы оценки AA

(Artificial Analysis)
Coding Index(Artificial Analysis)
60.2
Intelligence Index(Artificial Analysis)
42.9
Tau2(Sierra + U Toronto + Vector Institute (2025))
0.9
Gpqa(NYU + Cohere + Anthropic (2023))
0.9
Ifbench(Google Research (2023))
0.8
Lcr(Artificial Analysis)
0.8
Terminalbench V2 1
0.7
Scicode(UIUC + Argonne National Lab (2024))
0.5
Terminalbench Hard(Stanford × Laude Institute (2026))
0.4
Hle(Center for AI Safety + Scale AI (2025))
0.4
Tau Banking
0.1

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Language
90
Legal
80
Math
80
Reasoning
80
Frontend Development
80
Healthcare
80
Physics
70
Finance
70
General
70
Biology
70
Chemistry
70
Code
70
Tool Calling
70
Long Context
60
Agents
60
Coding
40
Vision
30

Цены

Цена ввода$0.435 / 1M токенов
Цена вывода$0.87 / 1M токенов
Смешанная цена (3:1)$0.544 / 1M токенов
Цена чтения кэша$0.0036 / 1M токенов

Скорость

Токенов/сек48.1
Задержка первого токена2.82s
Время до первого ответа44.40s

Рейтинг цен провайдеров

Рейтинг цен провайдеров

8 провайдеров

Самый дешевый: XiaomiСамый дорогой: EmpirioLabs AI
ПровайдерВводВывод
1XiaomiСамый дешевый
$0
$0
2DeepInfra
$0
$0
3Novita
$0
$0.00001
4DigitalOcean
$0.4
$1.5
5CrofAI
$0.4
$0.8
6OpenCode Go
$0.435
$0.87
7LLM Gateway
$0.435
$0.87
8EmpirioLabs AI
$2.175
$4.35

Сравнение цен разных API-провайдеров для этой модели.

Внешние ссылки