Saltar al contenido principal

Gemini 2.5 Pro

GoogleGeminiProprietary

Descripción

A highly capable AI model from Google, designed for the agentic era. Gemini 2.5 Pro performs well on common benchmarks with enhanced reasoning, multimodal capabilities (text, image, video, audio input), and a 1M token context window.

Fecha de lanzamiento
2025-06-05
Parámetros
—
Longitud del contexto
1.0M
Modalidades
audio, image, pdf, text, video

Radar de capacidades

38
general
51
coding
89
reasoning
59
science
78
agents
80
multimodal

Rankings

Dominio#PosiciónPuntuaciónFuente
Audio66
41.0
AA
Ranking de codificación256
57.0
AA
Ranking general235
50.0
AA
Ranking multimodal31
60.0
LS
Ciencia180
62.0
AA

Puntuaciones de benchmarks (LLM Stats)

(LLM Stats (zeroeval))

Factuality

SimpleQA54.0%Aut.

General

Global-MMLU-Lite89.2%Aut.
Aider-Polyglot82.2%Aut.
Aider-Polyglot Edit72.7%Aut.

Long Context

MRCR93.0%Aut.
MRCR 1M (pointwise)82.9%Aut.
MRCR v2 (8-needle)16.4%Aut.

Math

AIME 202492.0%Aut.
AIME 202588.0%Aut.

Multimodal

Video-MME84.8%Aut.
VideoMMMU83.6%Aut.
MMMU82.0%Aut.
Vibe-Eval67.2%Aut.

Reasoning

FACTS Grounding87.8%Aut.
GPQANYU + Cohere + Anthropic (2023)86.4%Aut.
LiveCodeBench v575.6%Aut.
LiveCodeBench69.0%Aut.
SWE-Bench Verified67.2%Aut.
Humanity's Last Exam21.6%Aut.
ARC-AGI v24.9%

Índices de evaluación AA

(Artificial Analysis)
Math 500(OpenAI (2024), subset of Hendrycks et al. MATH (2021))
96.7
Aime(MAA (Mathematical Association of America))
88.7
Math Index(Artificial Analysis)
87.7
Aime 25(MAA (Mathematical Association of America))
87.7
Mmlu Pro(TIGER-Lab (Univ. of Waterloo, Toronto, CMU, 2024))
86.2
Gpqa(NYU + Cohere + Anthropic (2023))
84.4
Livecodebench(UC Berkeley + MIT + Cornell (2024))
80.1
Lcr(Artificial Analysis)
69.0
Tau2(Sierra + U Toronto + Vector Institute (2025))
54.1
Ifbench(Google Research (2023))
48.7
Scicode(UIUC + Argonne National Lab (2024))
46.3
Coding Index(Artificial Analysis)
33.3
Terminalbench V2 1
28.5
Terminalbench Hard(Stanford × Laude Institute (2026))
26.5
Hle(Center for AI Safety + Scale AI (2025))
22.5
Intelligence Index(Artificial Analysis)
16.1
Tau Banking
9.7
Terminalbench V4 0
0.0

Puntuaciones por categoría LLM Stats

(LLM Stats (zeroeval))
Language
90
Long Context
90
Multimodal
80
Physics
80
Healthcare
80
Biology
80
Chemistry
80
Reasoning
70
General
70
Code
70
Math
60
Frontend Development
60
Factuality
50
Vision
50
Spatial Reasoning
0

Precios

Precio de entrada$1.25 / 1M tokens
Precio de salida$10 / 1M tokens
Precio mixto (3:1)$3.438 / 1M tokens
Precio de lectura caché$0.125 / 1M tokens

Velocidad

Tokens/seg0.0
Retraso del primer token0.00s
Tiempo hasta la respuesta0.00s

Ranking de Precios por Proveedor

Ranking de Precios por Proveedor

27 proveedores

Más barato: GoogleMás caro: Cortecs
ProveedorEntradaSalida
1GoogleMás barato
$0
$0.00001
2DeepInfra
$0
$0.00001
3Poe
$0.87
$7
4Jiekou.AI
$1.125
$9
5302.AI
$1.25
$10
6NanoGPT
$1.25
$10
7Abacus
$1.25
$10
8Perplexity Agent
$1.25
$10
9OpenRouter
$1.25
$10
10ZenMux
$1.25
$10
11Kilo Gateway
$1.25
$10
12SAP AI Core
$1.25
$10
13Helicone
$1.25
$10
14FrogBot
$1.25
$10
15AIHubMix
$1.25
$10
16Vercel AI Gateway
$1.25
$10
17DevPass (LLM Gateway)
$1.25
$10
18Vertex
$1.25
$10
19FastRouter
$1.25
$10
20Auriko
$1.25
$10
21NEAR AI Cloud
$1.25
$10
22OrcaRouter
$1.25
$10
23Merge Gateway
$1.25
$10
24Ofox
$1.25
$10
25Modelis
$1.25
$10
26Impossibl
$1.25
$10
27Cortecs
$1.495
$9.964

Comparar precios entre diferentes proveedores de API para este modelo.

Fuentes externas