メインコンテンツへスキップ

Qwen2 Instruct 72B

AlibabaQwenオープンウエイトtongyi-qianwen

説明

Qwen2-72B-Instruct is an instruction-tuned language model with 72 billion parameters, supporting a context length of up to 131,072 tokens. It's part of the new Qwen2 series, which has surpassed most open-source models and demonstrates competitiveness against proprietary models across various benchmarks.

リリース日
2024-06-07
パラメータ
72.0B
コンテキスト長
モダリティ

能力レーダー

22
general
17
coding
36
reasoning
25
science
30
agents
0
multimodal

ランキング

ドメイン#順位スコアソース
コーディングランキング454
17.0
AA
総合ランキング453
28.0
AA
科学475
25.0
AA

ベンチマークスコア (LLM Stats)

(LLM Stats (zeroeval))

Biology

GPQANYU + Cohere + Anthropic (2023)42.4%自己申告

Code

HumanEvalOpenAI (2021)86.0%自己申告
EvalPlus0.79 / 100自己申告

Finance

MMLU82.3%自己申告
MMLU-Pro64.4%自己申告
TruthfulQA54.8%自己申告
TheoremQA44.4%自己申告

General

CMMLU90.1%自己申告
C-Eval83.8%自己申告
MBPP0.80 / 100自己申告
MultiPL-E69.2%自己申告
ARC-C68.9%自己申告

Language

Winogrande85.1%自己申告
BBH82.4%自己申告

Math

GSM8k91.1%自己申告
MATH59.7%自己申告

Reasoning

HellaSwagAI2 (2019)87.6%自己申告

AA評価指数

(Artificial Analysis)
Intelligence Index(Artificial Analysis)
5.7
Math 500(OpenAI (2024), subset of Hendrycks et al. MATH (2021))
0.7
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
0.6
Gpqa(NYU + Cohere + Anthropic (2023))
0.4
Scicode(UIUC + Argonne National Lab (2024))
0.2
Livecodebench(UC Berkeley + MIT + Cornell (2024))
0.2
Aime(MAA (Mathematical Association of America))
0.1
Hle(Center for AI Safety + Scale AI (2025))
0.0

LLM Statsカテゴリスコア

(LLM Stats (zeroeval))
Language
80
Code
80
Legal
70
Math
70
Reasoning
70
General
70
Healthcare
70
Finance
60
Physics
40
Biology
40
Chemistry
40

価格設定

入力価格無料
出力価格無料
混合価格(3:1)無料

速度

トークン/秒0.0
初トークン遅延0.00s
初回答遅延0.00s

プロバイダー価格ランキング

プロバイダーデータがありません

外部リンク