Перейти к основному содержанию

Gemma 3 4B Instruct

GoogleGemmaОткрытые весаGemma · Коммерческое использование

Описание

Gemma 3 4B is a 4-billion-parameter vision-language model from Google, handling text and image input and generating text output. It features a 128K context window, multilingual support, and open weights. Suitable for question answering, summarization, reasoning, and image understanding tasks.

Дата выхода
2025-03-12
Параметры
4.0B
Длина контекста
131K
Модальности
image, text

Радар способностей

16
general
6
coding
22
reasoning
22
science
17
agents
70
multimodal

Рейтинги

Домен#МестоОценкаИсточник
Рейтинг кодинга616
5.0
AA
Общий рейтинг631
15.0
AA
Мультимодальный рейтинг133
32.0
LS
Наука623
15.0
AA

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Chat

IFEvalGoogle Research (2023)90.2%Сам.

Factuality

SimpleQA4.0%Сам.

General

Global-MMLU-Lite54.5%Сам.

Language

WMT24++46.8%Сам.
MMLU-Pro43.6%Сам.
ECLeKTic4.6%Сам.

Math

GSM8k89.2%Сам.
MATH75.6%Сам.
MathVista-Mini50.0%Сам.
HiddenMath43.0%Сам.

Reasoning

BIG-Bench Hard72.2%Сам.
HumanEvalOpenAI (2021)71.3%Сам.
Natural2Code70.3%Сам.
FACTS Grounding70.1%Сам.
ChartQAMasry et al. (2022)68.8%Сам.
MBPP0.63 / 100Сам.
Bird-SQL (dev)36.3%Сам.
GPQANYU + Cohere + Anthropic (2023)30.8%Сам.
LiveCodeBench12.6%Сам.
BIG-Bench Extra Hard11.0%Сам.

Vision

DocVQADocVQA (2020)75.8%Сам.
AI2D74.8%Сам.
VQAv2 (val)62.4%Сам.
TextVQA57.8%Сам.
InfoVQA50.0%Сам.
MMMU (val)48.8%Сам.

Индексы оценки AA

(Artificial Analysis)
Math 500(OpenAI (2024), subset of Hendrycks et al. MATH (2021))
76.6
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
41.7
Gpqa(NYU + Cohere + Anthropic (2023))
29.1
Ifbench(Google Research (2023))
28.3
Math Index(Artificial Analysis)
12.7
Aime 25(MAA (Mathematical Association of America))
12.7
Livecodebench(UC Berkeley + MIT + Cornell (2024))
11.2
Lcr(Artificial Analysis)
6.7
Aime(MAA (Mathematical Association of America))
6.3
Hle(Center for AI Safety + Scale AI (2025))
5.3
Tau2(Sierra + U Toronto + Vector Institute (2025))
5.0
Intelligence Index(Artificial Analysis)
4.8
Coding Index(Artificial Analysis)
2.7
Terminalbench Hard(Stanford × Laude Institute (2026))
0.8
Tau Banking
0.4
Terminalbench V2 1
0.4

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Chat
90
Instruction Following
90
Structured Output
90
Image To Text
70
Grounding
70
Math
60
Multimodal
60
Vision
60
Reasoning
50
General
50
Healthcare
50
Language
40
Legal
40
Factuality
40
Finance
40
Code
40
Physics
30
Biology
30
Chemistry
30

Цены

Цена вводаБесплатно
Цена выводаБесплатно
Смешанная цена (3:1)Бесплатно

Скорость

Токенов/сек0.0
Задержка первого токена0.00s
Время до первого ответа0.00s

Рейтинг цен провайдеров

Рейтинг цен провайдеров

6 провайдеров

Самый дешевый: DeepInfraСамый дорогой: Kilo Gateway
ПровайдерВводВывод
1DeepInfraСамый дешевый
$0
$0
2Merge Gateway
$0.04
$0.08
3OpenRouter
$0.05
$0.1
4Hugging Face
$0.05
$0.1
5Deep Infra
$0.05
$0.1
6Kilo Gateway
$0.05
$0.1

Сравнение цен разных API-провайдеров для этой модели.

Внешние ссылки