Перейти к основному содержанию

Phi-4 Mini Instruct

MicrosoftPhiОткрытые весаMIT · Коммерческое использование

Описание

Phi 4 Mini Instruct is a lightweight (3.8B parameters) open model built upon synthetic data and filtered web data, focusing on high-quality reasoning. It supports a 128K token context length and is enhanced for instruction adherence and safety via supervised fine-tuning and direct preference optimization.

Дата выхода
2024-02-26
Параметры
3.8B
Длина контекста
Модальности

Радар способностей

18
general
8
coding
18
reasoning
20
science
15
agents
0
multimodal

Рейтинги

Домен#МестоОценкаИсточник
Рейтинг кодинга515
9.0
AA
Общий рейтинг526
17.0
AA
Наука518
17.0
AA

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Biology

GPQANYU + Cohere + Anthropic (2023)52.0%Сам.

Creativity

Social IQa72.5%Сам.
Arena Hard32.8%Сам.

Finance

MMLU67.3%Сам.
TruthfulQA66.4%Сам.
MMLU-Pro52.8%Сам.

General

ARC-C83.7%Сам.
OpenBookQA79.2%Сам.
PIQA77.6%Сам.
Multilingual MMLU49.3%Сам.

Language

BoolQ81.2%Сам.
BIG-Bench Hard70.4%Сам.
Winogrande67.0%Сам.

Math

MATH-50094.6%Сам.
GSM8k88.6%Сам.
MATH64.0%Сам.
MGSM63.9%Сам.
AIMEMAA57.5%Сам.

Reasoning

HellaSwagAI2 (2019)69.1%Сам.

Индексы оценки AA

(Artificial Analysis)
Math Index(Artificial Analysis)
6.7
Intelligence Index(Artificial Analysis)
5.7
Coding Index(Artificial Analysis)
3.8
Math 500(OpenAI (2024), subset of Hendrycks et al. MATH (2021))
0.7
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
0.5
Gpqa(NYU + Cohere + Anthropic (2023))
0.3
Ifbench(Google Research (2023))
0.2
Lcr(Artificial Analysis)
0.2
Livecodebench(UC Berkeley + MIT + Cornell (2024))
0.1
Scicode(UIUC + Argonne National Lab (2024))
0.1
Tau2(Sierra + U Toronto + Vector Institute (2025))
0.1
Aime 25(MAA (Mathematical Association of America))
0.1
Hle(Center for AI Safety + Scale AI (2025))
0.0
Aime(MAA (Mathematical Association of America))
0.0
Terminalbench V2 1
0.0
Terminalbench Hard(Stanford × Laude Institute (2026))
0.0

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Math
70
Psychology
70
Reasoning
70
General
70
Legal
60
Language
60
Finance
60
Healthcare
60
Physics
50
Creativity
50
Biology
30
Chemistry
30
Writing
30

Цены

Цена вводаБесплатно
Цена выводаБесплатно
Смешанная цена (3:1)Бесплатно

Скорость

Токенов/сек45.1
Задержка первого токена0.34s
Время до первого ответа0.34s

Рейтинг цен провайдеров

Рейтинг цен провайдеров

2 провайдеров

Самый дешевый: Azure Cognitive ServicesСамый дорогой: Azure
ПровайдерВводВывод
1Azure Cognitive ServicesСамый дешевый
$0.075
$0.3
2Azure
$0.075
$0.3

Сравнение цен разных API-провайдеров для этой модели.

Внешние ссылки