Grok-2
xAIGrokProprietary
Descripción
Grok-2 is a frontier language model with state-of-the-art reasoning capabilities, featuring advanced abilities in chat, coding, and reasoning. It demonstrates superior performance in visual math reasoning, document-based question answering, and excels across various academic benchmarks including reasoning, reading comprehension, math, and science.
Fecha de lanzamiento
2024-08-13
Parámetros
—
Longitud del contexto
—
Modalidades
image, text
Radar de capacidades
80
general
90
coding
80
reasoning
51
scienceest.
83
agents
90
multimodal
Science se estima a partir de las puntuaciones científicas de LLM Stats o del razonamiento cuando no hay benchmarks científicos dedicados.
Rankings
No hay datos de ranking disponibles
Puntuaciones de benchmarks (LLM Stats)
(LLM Stats (zeroeval))Biology
GPQANYU + Cohere + Anthropic (2023)
56.0%Aut.
Code
HumanEvalOpenAI (2021)
88.4%Aut.
Finance
MMLU
87.5%Aut.
MMLU-Pro
75.5%Aut.
General
MMMU
66.1%Aut.
Image To Text
DocVQADocVQA (2020)
93.6%Aut.
Math
MATH
76.1%Aut.
MathVista
69.0%Aut.
Índices de evaluación AA
(Artificial Analysis)No hay datos de evaluación AA disponibles
Puntuaciones por categoría LLM Stats
(LLM Stats (zeroeval))Image To Text90
Code90
Legal80
Math80
Multimodal80
Language80
Finance80
General80
Healthcare80
Vision80
Reasoning70
Physics60
Biology60
Chemistry60
Precios
No hay datos de precios disponibles
Velocidad
No hay datos de velocidad disponibles
Ranking de Precios por Proveedor
No hay datos de proveedores disponibles