Passer au contenu principal

MiMo-V2-Flash (Non-reasoning)

XiaomiOpen WeightMIT · Usage Commercial

Description

MiMo-V2-Flash is a powerful, efficient, and ultra-fast foundation language model that excels in reasoning, coding, and agentic scenarios. It is a Mixture-of-Experts model with 309B total parameters and 15B active parameters, featuring a hybrid attention architecture with sliding-window and full attention (5:1 ratio, 128-token window). Delivers 150 tokens/sec inference with 256k context window.

Date de sortie
2025-12-16
Paramètres
309.0B
Longueur du contexte
262K
Modalités
text

Radar de capacités

32
general
46
coding
67
reasoning
48
science
60
agents
0
multimodal

Classements

Domaine#RangScoreSource
Classement codage296
49.0
AA
Classement général222
51.0
AA
Science373
39.0
AA

Scores de benchmarks (LLM Stats)

(LLM Stats (zeroeval))

General

Arena-Hard v286.2%Aut.
Tau-bench80.3%Aut.

Language

MMLU-Pro84.9%Aut.

Long Context

LongBench v260.6%Aut.
MRCR45.7%Aut.

Math

AIME 202594.1%Aut.
HMMT 202584.4%Aut.

Reasoning

GPQANYU + Cohere + Anthropic (2023)83.7%Aut.
LiveCodeBench v680.6%Aut.
SWE-Bench Verified73.4%Aut.
SWE-bench Multilingual71.7%Aut.
BrowseCompOpenAI (2025)58.3%Aut.
Terminal-Bench 2.0Stanford × Laude Institute (2026)38.5%Aut.
Terminal-Bench30.5%Aut.
Humanity's Last Exam22.1%Aut.

Indices d'évaluation AA

(Artificial Analysis)
Tau2(Sierra + U Toronto + Vector Institute (2025))
83.9
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
74.4
Math Index(Artificial Analysis)
67.7
Aime 25(MAA (Mathematical Association of America))
67.7
Gpqa(NYU + Cohere + Anthropic (2023))
65.6
Terminalbench V2 1
61.8
Coding Index(Artificial Analysis)
49.8
Livecodebench(UC Berkeley + MIT + Cornell (2024))
40.2
Ifbench(Google Research (2023))
39.9
Lcr(Artificial Analysis)
36.3
Terminalbench Hard(Stanford × Laude Institute (2026))
25.8
Intelligence Index(Artificial Analysis)
16.0
Hle(Center for AI Safety + Scale AI (2025))
8.6

Scores par catégorie LLM Stats

(LLM Stats (zeroeval))
Creativity
90
Writing
90
Language
80
Legal
80
Physics
80
Finance
80
Healthcare
80
Biology
80
Chemistry
80
Math
70
Reasoning
70
Frontend Development
70
General
70
Search
60
Structured Output
60
Tool Calling
60
Long Context
50
Agents
50
Code
50
Vision
20

Tarification

Prix d'entréeGratuit
Prix de sortieGratuit
Prix mixte (3:1)Gratuit
Prix de lecture cache$0.0028 / 1M tokens

Vitesse

Tokens/sec0.0
Délai du premier token0.00s
Temps de réponse0.00s

Classement des Prix par Fournisseur

Classement des Prix par Fournisseur

2 fournisseurs

Moins cher: QiniuPlus cher: Xiaomi
FournisseurEntréeSortie
1QiniuMoins cher
$0.1
$0.3
2Xiaomi
$0.14
$0.28

Comparer les prix entre différents fournisseurs API pour ce modèle.

Sources externes