Saltar al contenido principal

GPT-5.6 Terra (Max)

OpenAIGPTProprietary

Descripción

GPT-5.6 Terra is the balanced tier of OpenAI's GPT-5.6 family, designed for workloads that balance intelligence and cost. It delivers performance competitive with GPT-5.5 at roughly half the price, supports max reasoning effort, and has a 1.05M-token context window.

Fecha de lanzamiento
2026-07-09
Parámetros
—
Longitud del contexto
1.1M
Modalidades
image, pdf, text

Radar de capacidades

42
general
73
coding
93
reasoning
69
science
60
agents
85
multimodal

Rankings

Dominio#PosiciónPuntuaciónFuente
Capacidad agéntica71
44.0
LS
Ranking de codificación22
92.0
AA
Ranking general13
79.0
AA
Razonamiento matemático13
95.0
LB
Ranking multimodal77
52.0
LS
Razonamiento8
91.0
LB
Ciencia24
82.0
AA

Puntuaciones de benchmarks (LLM Stats)

(LLM Stats (zeroeval))

Agents

Connectors100.0%Aut.
Search and Function-Calling94.6%Aut.
Capture-the-Flag Challenges (Internal)91.8%Aut.
Internal Research Debugging Evaluation67.8%Aut.
SEC-bench Pro57.7%Aut.
RSI Index56.3%Aut.
LifeSciBench56.0%Aut.
Toolathlon53.1%Aut.
PostTrainBench Lite51.5%Aut.
Big Finance Bench51.0%Aut.
Agents' Last Exam50.4%Aut.
KernelGen 1P49.2%Aut.
Management Consulting Tasks (Internal)37.2%Aut.
GeneBench-Pro23.3%Aut.
ExploitGym23.2%Aut.
AutomationBench15.2%Aut.
NanoGPT14.5%Aut.

Code

BenchCAD (with Python tool)78.2%Aut.
DeepSWE 1.170.0%
DeepSWE69.6%Aut.
BenchCAD62.3%Aut.
ExploitBench52.9%Aut.

General

Artificial Analysis55.0%
GDP.pdf24.7%Aut.

Healthcare

HealthBench Consensus95.1%Aut.
HealthBench Professional57.7%Aut.
HealthBench57.0%Aut.
HealthBench Hard32.7%Aut.

Long Context

MRCR v2 (8-needle)89.6%Aut.
MRCR v2 (8-needle, 512K-1M)72.5%Aut.

Math

FrontierMath84.9%Aut.
FrontierMath Tier 4 (v2)68.3%Aut.

Multimodal

OSWorld 2.050.2%Aut.

Reasoning

GPQANYU + Cohere + Anthropic (2023)92.9%Aut.
BrowseCompOpenAI (2025)87.5%Aut.
Terminal-Bench 2.187.4%Aut.
Graphwalks BFS >128k76.9%Aut.
Graphwalks BFS 1M71.2%Aut.
SWE-Bench ProPrinceton NLP (2024)63.4%Aut.
FrontierCode 1.141.3%
MedChemBench (Internal)35.0%Aut.
Terminal-Bench 4.021.5%
ARC-AGI-30.8%Aut.

Vision

MMMU-Pro (with tools)82.0%Aut.
MMMU-Pro80.7%Aut.

Índices de evaluación AA

(Artificial Analysis)
Gpqa(NYU + Cohere + Anthropic (2023))
92.5
Terminalbench V2 1
88.0
Tau2(Sierra + U Toronto + Vector Institute (2025))
86.3
Lcr(Artificial Analysis)
83.0
Coding Index(Artificial Analysis)
76.7
Ifbench(Google Research (2023))
71.2
Terminalbench Hard(Stanford × Laude Institute (2026))
57.6
Scicode(UIUC + Argonne National Lab (2024))
55.0
Hle(Center for AI Safety + Scale AI (2025))
42.9
Intelligence Index(Artificial Analysis)
42.1
Tau Banking
40.2
Terminalbench V4 0
35.4

Puntuaciones por categoría LLM Stats

(LLM Stats (zeroeval))
Physics
90
Search
90
Biology
90
Chemistry
90
Long Context
80
Math
80
Spatial Reasoning
70
Multimodal
60
Reasoning
60
Safety
60
General
60
Healthcare
60
Agents
60
Code
60
Tool Calling
60
Vision
60
Science
40
Finance
40
Systems
40

Precios

Precio de entrada$2 / 1M tokens
Precio de salida$12 / 1M tokens
Precio mixto (3:1)$4.5 / 1M tokens
Precio de lectura caché$0.2 / 1M tokens
Precio de escritura caché$2.5 / 1M tokens

Velocidad

Tokens/seg102.2
Retraso del primer token97.36s
Tiempo hasta la respuesta97.36s

Ranking de Precios por Proveedor

Ranking de Precios por Proveedor

2 proveedores

Más barato: OpenAIMás caro: Neon
ProveedorEntradaSalida
1OpenAIMás barato
$0
$0.00001
2Neon
$2
$12

Comparar precios entre diferentes proveedores de API para este modelo.

Fuentes externas