Passer au contenu principal

Grok-2

xAIGrokProprietary

Description

Grok-2 is a frontier language model with state-of-the-art reasoning capabilities, featuring advanced abilities in chat, coding, and reasoning. It demonstrates superior performance in visual math reasoning, document-based question answering, and excels across various academic benchmarks including reasoning, reading comprehension, math, and science.

Date de sortie
2024-08-13
Paramètres
—
Longueur du contexte
—
Modalités
image, text

Radar de capacités

80
general
90
coding
80
reasoning
51
scienceest.
83
agents
90
multimodal

Science est estimé à partir des scores scientifiques de LLM Stats ou du raisonnement lorsque les benchmarks scientifiques dédiés ne sont pas disponibles.

Classements

Domaine#RangScoreSource
Classement multimodal98
47.0
LS

Scores de benchmarks (LLM Stats)

(LLM Stats (zeroeval))

General

MMLU87.5%Aut.

Language

MMLU-Pro75.5%Aut.

Math

MATH76.1%Aut.
MathVista69.0%Aut.

Multimodal

MMMU66.1%Aut.

Reasoning

HumanEvalOpenAI (2021)88.4%Aut.
GPQANYU + Cohere + Anthropic (2023)56.0%Aut.

Vision

DocVQADocVQA (2020)93.6%Aut.

Indices d'évaluation AA

(Artificial Analysis)

Aucune donnée d'évaluation AA disponible

Scores par catégorie LLM Stats

(LLM Stats (zeroeval))
Image To Text
90
Code
90
Language
80
Legal
80
Math
80
Multimodal
80
Finance
80
General
80
Healthcare
80
Vision
80
Reasoning
70
Physics
60
Biology
60
Chemistry
60

Tarification

Aucune donnée de prix disponible

Vitesse

Aucune donnée de vitesse disponible

Classement des Prix par Fournisseur

Aucune donnée de fournisseur disponible

Sources externes