Saltar al contenido principal

MiMo-V2-Flash (Non-reasoning)

XiaomiOpen WeightMIT · Uso Comercial

Descripción

MiMo-V2-Flash is a powerful, efficient, and ultra-fast foundation language model that excels in reasoning, coding, and agentic scenarios. It is a Mixture-of-Experts model with 309B total parameters and 15B active parameters, featuring a hybrid attention architecture with sliding-window and full attention (5:1 ratio, 128-token window). Delivers 150 tokens/sec inference with 256k context window.

Fecha de lanzamiento
2025-12-16
Parámetros
309.0B
Longitud del contexto
262K
Modalidades
text

Radar de capacidades

37
general
44
coding
67
reasoning
40
science
60
agents
0
multimodal

Rankings

Dominio#PosiciónPuntuaciónFuente
Capacidad agéntica117
35.0
LS
Ranking de codificación216
51.0
AA
Ranking general187
57.0
AA
Ciencia331
41.0
AA

Puntuaciones de benchmarks (LLM Stats)

(LLM Stats (zeroeval))

Agents

Tau-bench80.3%Aut.
BrowseCompOpenAI (2025)58.3%Aut.
Terminal-Bench 2.0Stanford × Laude Institute (2026)38.5%Aut.
Terminal-Bench30.5%Aut.

Biology

GPQANYU + Cohere + Anthropic (2023)83.7%Aut.

Code

SWE-Bench Verified73.4%Aut.
SWE-bench Multilingual71.7%Aut.

Creativity

Arena-Hard v286.2%Aut.

Finance

MMLU-Pro84.9%Aut.

General

LiveCodeBench v680.6%Aut.
LongBench v260.6%Aut.
MRCR45.7%Aut.

Math

AIME 202594.1%Aut.
HMMT 202584.4%Aut.
Humanity's Last Exam22.1%Aut.

Índices de evaluación AA

(Artificial Analysis)
Math Index(Artificial Analysis)
67.7
Coding Index(Artificial Analysis)
49.8
Intelligence Index(Artificial Analysis)
25.1
Tau2(Sierra + U Toronto + Vector Institute (2025))
0.8
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
0.7
Aime 25(MAA (Mathematical Association of America))
0.7
Gpqa(NYU + Cohere + Anthropic (2023))
0.7
Terminalbench V2 1
0.6
Livecodebench(UC Berkeley + MIT + Cornell (2024))
0.4
Ifbench(Google Research (2023))
0.4
Lcr(Artificial Analysis)
0.3
Scicode(UIUC + Argonne National Lab (2024))
0.3
Terminalbench Hard(Stanford × Laude Institute (2026))
0.3
Hle(Center for AI Safety + Scale AI (2025))
0.1

Puntuaciones por categoría LLM Stats

(LLM Stats (zeroeval))
Creativity
90
Writing
90
Language
80
Legal
80
Physics
80
Finance
80
Healthcare
80
Biology
80
Chemistry
80
Math
70
Reasoning
70
Frontend Development
70
General
70
Search
60
Structured Output
60
Tool Calling
60
Long Context
50
Agents
50
Code
50
Vision
20

Precios

Precio de entradaGratis
Precio de salidaGratis
Precio mixto (3:1)Gratis
Precio de lectura caché$0.0028 / 1M tokens

Velocidad

Tokens/seg0.0
Retraso del primer token0.00s
Tiempo hasta la respuesta0.00s

Ranking de Precios por Proveedor

No hay datos de proveedores disponibles

Fuentes externas