Перейти к основному содержанию

Llama 3.1 Instruct 8B

MetaLlamaОткрытые весаLlama 3.1 Community License

Описание

Llama 3.1 8B Instruct is a multilingual large language model optimized for dialogue use cases. It features a 128K context length, state-of-the-art tool use, and strong reasoning capabilities.

Дата выхода
2024-07-23
Параметры
8.0B
Длина контекста
131K
Модальности
text

Радар способностей

19
general
8
coding
14
reasoning
20
science
50
agents
0
multimodal

Рейтинги

Домен#МестоОценкаИсточник
Рейтинг кодинга595
9.0
AA
Общий рейтинг568
21.0
AA
Наука636
13.0
AA

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Chat

IFEvalGoogle Research (2023)80.4%Сам.

General

BFCL76.1%Сам.
MMLU69.4%Сам.
Multipl-E MBPP52.4%Сам.
Nexus38.5%Сам.

Language

MMLU (CoT)73.0%Сам.
Multipl-E HumanEval50.8%Сам.
MMLU-Pro48.3%Сам.

Math

GSM-8K (CoT)84.5%Сам.
Multilingual MGSM (CoT)68.9%Сам.
MATH (CoT)51.9%Сам.

Reasoning

ARC-C83.4%Сам.
API-Bank82.6%Сам.
MBPP EvalPlus (base)72.8%Сам.
HumanEvalOpenAI (2021)72.6%Сам.
DROP59.5%Сам.
GPQANYU + Cohere + Anthropic (2023)30.4%Сам.
Gorilla Benchmark API Bench8.2%Сам.

Индексы оценки AA

(Artificial Analysis)
Math 500(OpenAI (2024), subset of Hendrycks et al. MATH (2021))
51.9
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
47.6
Ifbench(Google Research (2023))
28.6
Gpqa(NYU + Cohere + Anthropic (2023))
25.9
Lcr(Artificial Analysis)
18.0
Tau2(Sierra + U Toronto + Vector Institute (2025))
16.4
Livecodebench(UC Berkeley + MIT + Cornell (2024))
11.6
Aime(MAA (Mathematical Association of America))
7.7
Intelligence Index(Artificial Analysis)
6.9
Coding Index(Artificial Analysis)
5.4
Hle(Center for AI Safety + Scale AI (2025))
5.3
Aime 25(MAA (Mathematical Association of America))
4.3
Math Index(Artificial Analysis)
4.3
Terminalbench V2 1
1.5
Terminalbench Hard(Stanford × Laude Institute (2026))
0.8

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Chat
80
Instruction Following
80
Structured Output
80
Language
60
Legal
60
Math
60
Reasoning
60
Finance
60
General
60
Healthcare
60
Tool Calling
50
Code
40
Physics
30
Biology
30
Chemistry
30

Цены

Цена ввода$0.02 / 1M токенов
Цена вывода$0.05 / 1M токенов
Смешанная цена (3:1)$0.028 / 1M токенов
Цена чтения кэша$0.025 / 1M токенов

Скорость

Токенов/сек0.0
Задержка первого токена0.00s
Время до первого ответа0.00s

Рейтинг цен провайдеров

Рейтинг цен провайдеров

2 провайдеров

Самый дешевый: DeepInfraСамый дорогой: Meta
ПровайдерВводВывод
1DeepInfraСамый дешевый
$0
$0
2MetaОсновной
$0.02
$0.05

Сравнение цен разных API-провайдеров для этой модели.

Внешние ссылки