Saltar al contenido principal

Granite 4.0 Micro

IBMOpen WeightApache 2.0 · Uso Comercial

Descripción

A preliminary version of the smallest model in the upcoming Granite 4.0 family, released May 2025. It utilizes a novel hybrid Mamba-2/Transformer, fine-grained mixture of experts (MoE) architecture (7B total parameters, 1B active at inference). This preview version is partially trained (2.5T tokens) but demonstrates significant memory efficiency and performance potential, validated for at least 128K context length without positional encoding.

Fecha de lanzamiento
2025-09-22
Parámetros
7.0B
Longitud del contexto
131K
Modalidades
text

Radar de capacidades

15
general
17
coding
11
reasoning
20
science
13
agents
0
multimodal

Rankings

Dominio#PosiciónPuntuaciónFuente
Ranking de codificación516
9.0
AA
Ranking general537
16.0
AA
Ciencia513
18.0
AA

Puntuaciones de benchmarks (LLM Stats)

(LLM Stats (zeroeval))

Code

HumanEvalOpenAI (2021)82.4%Aut.

Creativity

AlpacaEval 2.035.2%Aut.
Arena Hard26.7%Aut.

Finance

MMLU60.4%Aut.
TruthfulQA58.1%Aut.

General

IFEvalGoogle Research (2023)63.0%Aut.
PopQA22.9%Aut.

Language

BIG-Bench Hard55.7%Aut.

Math

GSM8k70.1%Aut.
DROP46.2%Aut.

Reasoning

HumanEval+78.3%Aut.

Safety

AttaQ86.1%Aut.

Índices de evaluación AA

(Artificial Analysis)
Math Index(Artificial Analysis)
6.0
Intelligence Index(Artificial Analysis)
2.0
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
0.4
Gpqa(NYU + Cohere + Anthropic (2023))
0.3
Ifbench(Google Research (2023))
0.2
Livecodebench(UC Berkeley + MIT + Cornell (2024))
0.2
Tau2(Sierra + U Toronto + Vector Institute (2025))
0.1
Scicode(UIUC + Argonne National Lab (2024))
0.1
Aime 25(MAA (Mathematical Association of America))
0.1
Lcr(Artificial Analysis)
0.1
Hle(Center for AI Safety + Scale AI (2025))
0.1
Terminalbench Hard(Stanford × Laude Institute (2026))
0.0

Puntuaciones por categoría LLM Stats

(LLM Stats (zeroeval))
Safety
90
Code
80
Legal
60
Math
60
Structured Output
60
Instruction Following
60
Language
60
Finance
60
General
60
Healthcare
60
Reasoning
50
Creativity
30
Writing
30

Precios

Precio de entradaGratis
Precio de salidaGratis
Precio mixto (3:1)Gratis

Velocidad

Tokens/seg0.0
Retraso del primer token0.00s
Tiempo hasta la respuesta0.00s

Ranking de Precios por Proveedor

Ranking de Precios por Proveedor

2 proveedores

Más barato: OpenRouterMás caro: Kilo Gateway
ProveedorEntradaSalida
1OpenRouterMás barato
$0.017
$0.112
2Kilo Gateway
$0.017
$0.112

Comparar precios entre diferentes proveedores de API para este modelo.

Fuentes externas