Saltar al contenido principal

Grok-2

xAIGrokProprietary

Descripción

Grok-2 is a frontier language model with state-of-the-art reasoning capabilities, featuring advanced abilities in chat, coding, and reasoning. It demonstrates superior performance in visual math reasoning, document-based question answering, and excels across various academic benchmarks including reasoning, reading comprehension, math, and science.

Fecha de lanzamiento
2024-08-13
Parámetros
Longitud del contexto
Modalidades
image, text

Radar de capacidades

80
general
90
coding
80
reasoning
51
scienceest.
83
agents
90
multimodal

Science se estima a partir de las puntuaciones científicas de LLM Stats o del razonamiento cuando no hay benchmarks científicos dedicados.

Rankings

No hay datos de ranking disponibles

Puntuaciones de benchmarks (LLM Stats)

(LLM Stats (zeroeval))

Biology

GPQANYU + Cohere + Anthropic (2023)56.0%Aut.

Code

HumanEvalOpenAI (2021)88.4%Aut.

Finance

MMLU87.5%Aut.
MMLU-Pro75.5%Aut.

General

MMMU66.1%Aut.

Image To Text

DocVQADocVQA (2020)93.6%Aut.

Math

MATH76.1%Aut.
MathVista69.0%Aut.

Índices de evaluación AA

(Artificial Analysis)

No hay datos de evaluación AA disponibles

Puntuaciones por categoría LLM Stats

(LLM Stats (zeroeval))
Image To Text
90
Code
90
Legal
80
Math
80
Multimodal
80
Language
80
Finance
80
General
80
Healthcare
80
Vision
80
Reasoning
70
Physics
60
Biology
60
Chemistry
60

Precios

No hay datos de precios disponibles

Velocidad

No hay datos de velocidad disponibles

Ranking de Precios por Proveedor

No hay datos de proveedores disponibles

Fuentes externas