Kimi K2.5 (Non-reasoning)
KimiKimiОткрытые весаMIT · Коммерческое использование
Описание
Kimi K2.5 is Moonshot AI's flagship agentic model and a new SOTA open model. It unifies vision and text, thinking and non-thinking modes, and single-agent and multi-agent execution into one model. Built with Full-Parameter RL tuning, it achieves state-of-the-art performance across agents, coding, image, and video benchmarks.
Дата выхода
2026-01-27
Параметры
1.0T
Длина контекста
262K
Модальности
image, text, video
Радар способностей
26
general
40
coding
79
reasoning
52
science
50
agents
80
multimodal
Рейтинги
| Домен | #Место | Оценка | Источник |
|---|---|---|---|
| Агентные возможности | 130 | 33.0 | LS |
| Рейтинг кодинга | 205 | 54.0 | AA |
| Общий рейтинг | 208 | 55.0 | AA |
| Мультимодальный рейтинг | 27 | 57.0 | LS |
| Наука | 194 | 56.0 | AA |
Оценки бенчмарков (LLM Stats)
(LLM Stats (zeroeval))Agents
WideSearch
79.0%Сам.
DeepSearchQA
77.1%Сам.
BrowseCompOpenAI (2025)
74.9%Сам.
PaperBench
63.5%Сам.
Terminal-Bench 2.0Stanford × Laude Institute (2026)
50.8%Сам.
SWE-Bench ProPrinceton NLP (2024)
50.7%Сам.
CyberGym
41.3%Сам.
FrontierSWE
26.0%
Biology
GPQANYU + Cohere + Anthropic (2023)
87.6%Сам.
SciCode
48.7%Сам.
Code
SWE-Bench Verified
76.8%Сам.
SWE-bench Multilingual
73.0%Сам.
OJBench (C++)
57.4%Сам.
Economics
FinSearchComp T2&T3
67.8%Сам.
Finance
MMLU-Pro
87.1%Сам.
General
LiveCodeBench v6
85.0%Сам.
MMMU-Pro
78.5%Сам.
SimpleVQA
0.71 / 100Сам.
LiveBench
69.1%
LongBench v2
61.0%Сам.
Healthcare
VideoMMMU
86.6%Сам.
Image To Text
OCRBench
92.3%Сам.
Long Context
LongVideoBench
79.8%Сам.
LVBench
75.9%Сам.
AA-LCR
70.0%Сам.
Math
AIME 2025
96.1%Сам.
HMMT 2025
95.4%Сам.
MathVista-Mini
90.1%Сам.
MathVision
84.2%Сам.
IMO-AnswerBench
81.8%Сам.
Humanity's Last Exam
50.2%Сам.
Multimodal
InfoVQAtest
92.6%Сам.
OmniDocBench 1.5
88.8%Сам.
Video-MME
87.4%Сам.
MMVU
80.4%Сам.
CharXiv-R
77.5%Сам.
MotionBench
70.4%Сам.
WorldVQA
46.3%Сам.
ZEROBench
0.11 / 100Сам.
Reasoning
Seal-0
57.4%Сам.
Индексы оценки AA
(Artificial Analysis)Intelligence Index(Artificial Analysis)30.1
Tau2(Sierra + U Toronto + Vector Institute (2025))0.8
Gpqa(NYU + Cohere + Anthropic (2023))0.8
Lcr(Artificial Analysis)0.7
Ifbench(Google Research (2023))0.4
Scicode(UIUC + Argonne National Lab (2024))0.4
Terminalbench Hard(Stanford × Laude Institute (2026))0.2
Hle(Center for AI Safety + Scale AI (2025))0.1
Оценки категорий LLM Stats
(LLM Stats (zeroeval))Legal90
Language90
Finance90
Long Context80
Math80
Image To Text80
Frontend Development80
Video80
Multimodal70
Physics70
Reasoning70
Search70
Structured Output70
General70
Healthcare70
Biology70
Chemistry70
Vision70
Agents60
Code50
Tool Calling50
Safety40
Цены
Цена ввода$0.6 / 1M токенов
Цена вывода$3 / 1M токенов
Смешанная цена (3:1)$1.2 / 1M токенов
Цена чтения кэша$0.095 / 1M токенов
Скорость
Токенов/сек0.0
Задержка первого токена0.00s
Время до первого ответа0.00s
Рейтинг цен провайдеров
Рейтинг цен провайдеров
11 провайдеров
Самый дешевый: NanoGPTСамый дорогой: Ofox
ПровайдерВводВывод
1NanoGPTСамый дешевый
$0.3
$1.9
2TensorX
$0.5
$2.8
3OpenRouter
$0.57
$2.85
4ZenMux
$0.58
$3.02
5KimiОсновной
$0.6
$3
6Jiekou.AI
$0.6
$3
7NovitaAI
$0.6
$3
8Kilo Gateway
$0.6
$3
9Vercel AI Gateway
$0.6
$3
10HPC-AI
$0.6
$3
11Ofox
$0.6
$3
Сравнение цен разных API-провайдеров для этой модели.