Перейти к основному содержанию

Qwen2 7B Instruct

Alibaba Cloud / Qwen TeamQwenОткрытые весаApache 2.0 · Коммерческое использование

Описание

Qwen2-7B-Instruct is an instruction-tuned language model with 7 billion parameters, supporting a context length of up to 131,072 tokens.

Дата выхода
2024-07-23
Параметры
7.6B
Длина контекста
—
Модальности
—

Радар способностей

60
general
60
coding
60
reasoning
26
scienceоцен.
60
agents
0
multimodal

При отсутствии специализированных научных бенчмарков Science оценивается по научным категориям LLM Stats или на основе рассуждений.

Рейтинги

Нет данных рейтинга

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Chat

MT-Bench0.84 / 100Сам.

General

C-Eval77.2%Сам.
AlignBench72.1%Сам.
MMLU70.5%Сам.
MultiPL-E59.1%Сам.

Language

MMLU-Pro44.1%Сам.

Math

GSM8k82.3%Сам.
MATH49.6%Сам.
TheoremQA25.3%Сам.

Reasoning

HumanEvalOpenAI (2021)79.9%Сам.
EvalPlus0.70 / 100Сам.
MBPP0.67 / 100Сам.
LiveCodeBench26.6%Сам.
GPQANYU + Cohere + Anthropic (2023)25.3%Сам.

Индексы оценки AA

(Artificial Analysis)

Нет данных AA оценки

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Chat
80
Roleplay
80
Communication
80
Creativity
80
Writing
70
Reasoning
60
Language
60
Legal
60
Math
60
General
60
Healthcare
60
Code
60
Finance
50
Physics
30
Biology
30
Chemistry
30

Цены

Нет данных о ценах

Скорость

Нет данных о скорости

Рейтинг цен провайдеров

Нет данных провайдеров

Внешние ссылки