Phi-4
MicrosoftPhiOpen WeightMIT · Uso Comercial
Descripción
phi-4 is a state-of-the-art open model built to excel at advanced reasoning, coding, and knowledge tasks. It leverages a blend of synthetic data, filtered web data, academic texts, and supervised fine-tuning for precision, alignment, and safety.
Fecha de lanzamiento
2024-12-12
Parámetros
14.7B
Longitud del contexto
16K
Modalidades
text
Radar de capacidades
25
general
24
coding
30
reasoning
36
scienceest.
28
agents
0
multimodal
Science usa un proxy de razonamiento cuando los benchmarks científicos dedicados no están disponibles.
Rankings
| Dominio | #Posición | Puntuación | Fuente |
|---|---|---|---|
| Ranking de codificación | 447 | 10.0 | AA |
| Ranking general | 431 | 22.0 | AA |
| Razonamiento matemático | 267 | 30.0 | AA |
| Ciencia | 320 | 35.0 | AA |
Puntuaciones de benchmarks (LLM Stats)
Biology
GPQA
56.1%Aut.
Code
HumanEval
82.6%Aut.
Creativity
Arena Hard
75.4%Aut.
Factuality
SimpleQA
3.0%Aut.
Finance
MMLU
84.8%Aut.
MMLU-Pro
70.4%Aut.
General
IFEval
63.0%Aut.
PhiBench
56.2%Aut.
LiveBench
47.6%Aut.
Math
MGSM
80.6%Aut.
MATH
80.4%Aut.
DROP
75.5%Aut.
Reasoning
HumanEval+
82.8%Aut.
Índices de evaluación AA
Math Index18.0
Intelligence Index4.9
Math 5000.8
Mmlu Pro0.7
Gpqa0.6
Scicode0.3
Ifbench0.2
Livecodebench0.2
Aime 250.2
Aime0.1
Hle0.0
Terminalbench Hard0.0
Lcr0.0
Tau20.0
Puntuaciones por categoría LLM Stats
Language80
Legal80
Finance80
Healthcare80
Code80
Creativity80
Writing80
Math70
Reasoning70
Instruction Following60
Physics60
Structured Output60
General60
Biology60
Chemistry60
Factuality0
Precios
Precio de entrada$0.125 / 1M tokens
Precio de salida$0.5 / 1M tokens
Precio mixto (3:1)$0.219 / 1M tokens
Velocidad
Tokens/seg40.8
Retraso del primer token0.47s
Tiempo hasta la respuesta0.47s
Ranking de Precios por Proveedor
Ranking de Precios por Proveedor
3 proveedores
Más barato: MicrosoftMás caro: Azure
ProveedorEntradaSalida
1MicrosoftPRINCIPAL
$0.125
$0.5
2Azure Cognitive Services
$0.17
$0.68
3Azure
$0.17
$0.68
Comparar precios entre diferentes proveedores de API para este modelo.