Grok-2
xAIGrokProprietary
説明
Grok-2 is a frontier language model with state-of-the-art reasoning capabilities, featuring advanced abilities in chat, coding, and reasoning. It demonstrates superior performance in visual math reasoning, document-based question answering, and excels across various academic benchmarks including reasoning, reading comprehension, math, and science.
リリース日
2024-08-13
パラメータ
—
コンテキスト長
—
モダリティ
image, text
能力レーダー
80
general
90
coding
80
reasoning
51
science推定
83
agents
90
multimodal
専用の科学ベンチマークがない場合、Science は LLM Stats の科学スコアまたは推論能力から推定します。
ランキング
ランキングデータがありません
ベンチマークスコア (LLM Stats)
(LLM Stats (zeroeval))Biology
GPQANYU + Cohere + Anthropic (2023)
56.0%自己申告
Code
HumanEvalOpenAI (2021)
88.4%自己申告
Finance
MMLU
87.5%自己申告
MMLU-Pro
75.5%自己申告
General
MMMU
66.1%自己申告
Image To Text
DocVQADocVQA (2020)
93.6%自己申告
Math
MATH
76.1%自己申告
MathVista
69.0%自己申告
AA評価指数
(Artificial Analysis)AA評価データがありません
LLM Statsカテゴリスコア
(LLM Stats (zeroeval))Image To Text90
Code90
Legal80
Math80
Multimodal80
Language80
Finance80
General80
Healthcare80
Vision80
Reasoning70
Physics60
Biology60
Chemistry60
価格設定
価格データがありません
速度
速度データがありません
プロバイダー価格ランキング
プロバイダーデータがありません