Перейти к основному содержанию

Llama 3.2 Instruct 90B (Vision)

MetaLlamaОткрытые весаLlama 3.2 · Коммерческое использование

Описание

Llama 3.2 90B is a large multimodal language model optimized for visual recognition, image reasoning, and captioning tasks. It supports a context length of 128,000 tokens and is designed for deployment on edge and mobile devices, offering state-of-the-art performance in image understanding and generative tasks.

Дата выхода
2024-09-25
Параметры
90.0B
Длина контекста
—
Модальности
image, text

Радар способностей

24
general
21
coding
30
reasoning
31
science
27
agents
85
multimodal

Рейтинги

Домен#МестоОценкаИсточник
Рейтинг кодинга483
23.0
AA
Общий рейтинг505
28.0
AA
Мультимодальный рейтинг105
43.0
LS
Наука536
23.0
AA

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

General

MMLU86.0%Сам.

Math

MGSM86.9%Сам.
MATH68.0%Сам.
MathVista57.3%Сам.

Multimodal

MMMU60.3%Сам.

Reasoning

ChartQAMasry et al. (2022)85.5%Сам.
GPQANYU + Cohere + Anthropic (2023)46.7%Сам.

Vision

AI2D92.3%Сам.
DocVQADocVQA (2020)90.1%Сам.
VQAv278.1%Сам.
TextVQA73.5%Сам.
InfographicsQA56.8%Сам.
MMMU-Pro45.2%Сам.

Индексы оценки AA

(Artificial Analysis)
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
67.1
Math 500(OpenAI (2024), subset of Hendrycks et al. MATH (2021))
62.9
Gpqa(NYU + Cohere + Anthropic (2023))
43.2
Livecodebench(UC Berkeley + MIT + Cornell (2024))
21.4
Intelligence Index(Artificial Analysis)
6.4
Aime(MAA (Mathematical Association of America))
5.0
Hle(Center for AI Safety + Scale AI (2025))
4.5

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Language
90
Legal
90
Finance
90
Image To Text
80
Math
70
Multimodal
70
Reasoning
70
General
70
Healthcare
70
Vision
70
Physics
50
Biology
50
Chemistry
50

Цены

Цена вводаБесплатно
Цена выводаБесплатно
Смешанная цена (3:1)Бесплатно

Скорость

Токенов/сек0.0
Задержка первого токена0.00s
Время до первого ответа0.00s

Рейтинг цен провайдеров

Нет данных провайдеров

Внешние ссылки