メインコンテンツへスキップ

Qwen2 Instruct 72B

AlibabaQwenオープンウエイトtongyi-qianwen

説明

Qwen2-72B-Instruct is an instruction-tuned language model with 72 billion parameters, supporting a context length of up to 131,072 tokens. It's part of the new Qwen2 series, which has surpassed most open-source models and demonstrates competitiveness against proprietary models across various benchmarks.

リリース日
2024-06-07
パラメータ
72.0B
コンテキスト長
—
モダリティ
—

能力レーダー

23
general
16
coding
36
reasoning
27
science
30
agents
0
multimodal

ランキング

ドメイン#順位スコアソース
コーディングランキング533
17.0
AA
総合ランキング525
26.0
AA
科学582
18.0
AA

ベンチマークスコア (LLM Stats)

(LLM Stats (zeroeval))

General

C-Eval83.8%自己申告
MMLU82.3%自己申告
MultiPL-E69.2%自己申告
TruthfulQA54.8%自己申告

Language

CMMLU90.1%自己申告
MMLU-Pro64.4%自己申告

Math

GSM8k91.1%自己申告
MATH59.7%自己申告
TheoremQA44.4%自己申告

Reasoning

HellaSwagAI2 (2019)87.6%自己申告
HumanEvalOpenAI (2021)86.0%自己申告
Winogrande85.1%自己申告
BBH82.4%自己申告
MBPP0.80 / 100自己申告
EvalPlus0.79 / 100自己申告
ARC-C68.9%自己申告
GPQANYU + Cohere + Anthropic (2023)42.4%自己申告

AA評価指数

(Artificial Analysis)
Math 500(OpenAI (2024), subset of Hendrycks et al. MATH (2021))
70.1
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
62.2
Gpqa(NYU + Cohere + Anthropic (2023))
37.1
Livecodebench(UC Berkeley + MIT + Cornell (2024))
15.9
Aime(MAA (Mathematical Association of America))
14.7
Intelligence Index(Artificial Analysis)
6.3
Hle(Center for AI Safety + Scale AI (2025))
3.7

LLM Statsカテゴリスコア

(LLM Stats (zeroeval))
Language
80
Code
80
Legal
70
Math
70
Reasoning
70
General
70
Healthcare
70
Finance
60
Physics
40
Biology
40
Chemistry
40

価格設定

入力価格無料
出力価格無料
混合価格(3:1)無料

速度

トークン/秒0.0
初トークン遅延0.00s
初回答遅延0.00s

プロバイダー価格ランキング

プロバイダーデータがありません

外部リンク