MiMo-V2-Flash (Non-reasoning)
XiaomiOpen WeightMIT · Usage Commercial
Description
MiMo-V2-Flash is a powerful, efficient, and ultra-fast foundation language model that excels in reasoning, coding, and agentic scenarios. It is a Mixture-of-Experts model with 309B total parameters and 15B active parameters, featuring a hybrid attention architecture with sliding-window and full attention (5:1 ratio, 128-token window). Delivers 150 tokens/sec inference with 256k context window.
Date de sortie
2025-12-16
Paramètres
309.0B
Longueur du contexte
262K
Modalités
text
Radar de capacités
32
general
46
coding
67
reasoning
48
science
60
agents
0
multimodal
Classements
| Domaine | #Rang | Score | Source |
|---|---|---|---|
| Classement codage | 296 | 49.0 | AA |
| Classement général | 222 | 51.0 | AA |
| Science | 373 | 39.0 | AA |
Scores de benchmarks (LLM Stats)
(LLM Stats (zeroeval))General
Arena-Hard v2
86.2%Aut.
Tau-bench
80.3%Aut.
Language
MMLU-Pro
84.9%Aut.
Long Context
LongBench v2
60.6%Aut.
MRCR
45.7%Aut.
Math
AIME 2025
94.1%Aut.
HMMT 2025
84.4%Aut.
Reasoning
GPQANYU + Cohere + Anthropic (2023)
83.7%Aut.
LiveCodeBench v6
80.6%Aut.
SWE-Bench Verified
73.4%Aut.
SWE-bench Multilingual
71.7%Aut.
BrowseCompOpenAI (2025)
58.3%Aut.
Terminal-Bench 2.0Stanford × Laude Institute (2026)
38.5%Aut.
Terminal-Bench
30.5%Aut.
Humanity's Last Exam
22.1%Aut.
Indices d'évaluation AA
(Artificial Analysis)Tau2(Sierra + U Toronto + Vector Institute (2025))83.9
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))74.4
Math Index(Artificial Analysis)67.7
Aime 25(MAA (Mathematical Association of America))67.7
Gpqa(NYU + Cohere + Anthropic (2023))65.6
Terminalbench V2 161.8
Coding Index(Artificial Analysis)49.8
Livecodebench(UC Berkeley + MIT + Cornell (2024))40.2
Ifbench(Google Research (2023))39.9
Lcr(Artificial Analysis)36.3
Terminalbench Hard(Stanford × Laude Institute (2026))25.8
Intelligence Index(Artificial Analysis)16.0
Hle(Center for AI Safety + Scale AI (2025))8.6
Scores par catégorie LLM Stats
(LLM Stats (zeroeval))Creativity90
Writing90
Language80
Legal80
Physics80
Finance80
Healthcare80
Biology80
Chemistry80
Math70
Reasoning70
Frontend Development70
General70
Search60
Structured Output60
Tool Calling60
Long Context50
Agents50
Code50
Vision20
Tarification
Prix d'entréeGratuit
Prix de sortieGratuit
Prix mixte (3:1)Gratuit
Prix de lecture cache$0.0028 / 1M tokens
Vitesse
Tokens/sec0.0
Délai du premier token0.00s
Temps de réponse0.00s
Classement des Prix par Fournisseur
Classement des Prix par Fournisseur
2 fournisseurs
Moins cher: QiniuPlus cher: Xiaomi
FournisseurEntréeSortie
1QiniuMoins cher
$0.1
$0.3
2Xiaomi
$0.14
$0.28
Comparer les prix entre différents fournisseurs API pour ce modèle.