DECISIÓN / COMPARADOR

Modelos frente a frente.

Una lectura común de capacidades, acceso, contexto, precio y fecha de verificación.

Elige entre dos y tres modelos
O
Encaja mejor en
Razonamiento complejo, investigación, código, documentos y agentes con herramientas.
Conviene vigilar
Mayor precio por token; requiere permisos mínimos y revisión en acciones sensibles.
A
Anthropic

Claude Opus 5

Encaja mejor en
Código agentivo, refactorizaciones amplias, conocimiento empresarial y trabajo visual.
Conviene vigilar
Las respuestas tienden a ser extensas y el pensamiento activo puede elevar tokens de salida.
Encaja mejor en
Agentes de bajo coste, software de larga duración y análisis multimodal amplio.
Conviene vigilar
El precio es introductorio y el uso de grounding puede generar cargos por consulta.
CriterioGPT‑6 AstraClaude Opus 5Gemini 3.8 Flash
Identidad y vigencia
OrganizaciónOpenAIAnthropicGoogle
ID de APIgpt-6-astraclaude-opus-5gemini-3.8-flash
EstadoDisponibleActivoEstable · GA
Lanzamiento3 de septiembre de 202624 de julio de 20262 de septiembre de 2026
Corte de conocimiento30 de abril de 2026Mayo de 2026No publicado en la fuente consultada
PerfilFrontera generalistaConocimiento y códigoMultimodal veloz
Capacidad y modalidades
EntradaTexto · ImagenTexto · ImagenTexto · Imagen · Vídeo · Audio · PDF
SalidaTextoTextoTexto
Ventana de contexto1.050.000 tokens1.000.000 tokens1.048.576 tokens de entrada
Salida máxima128.000 tokens128.000 tokens65.536 tokens de salida
RazonamientoEsfuerzo low, medium, high, xhigh y maxPensamiento adaptativo · esfuerzo configurableNiveles low, medium y high
Latencia relativaModerada; depende del esfuerzo de razonamientoModerada · modo Fast disponible en la APIPerfil Flash orientado a velocidad y eficiencia
Herramientas e integración
Herramientas publicadasFunciones · Búsqueda web · Búsqueda en archivos · Intérprete de código · Shell alojado · Uso de ordenador · MCPUso de herramientas · Búsqueda web · Ejecución de código · Uso de ordenadorFunciones · Búsqueda web · Google Maps · Ejecución de código · Uso de ordenador (preview) · Búsqueda en archivos · Contexto de URL
Salidas estructuradasCompatibleCompatibleCompatible
Procesamiento por lotesCompatible · 50 % de descuentoCompatible · 50 % de descuentoCompatible · 50 % de descuento
Caché de promptsCompatibleCompatible · hasta 90 % de ahorro en lecturasCompatible
Ajuste finoNo compatibleNo publicado en la fuente consultadaNo publicado en la fuente consultada
Precio estándar de API
Precio de entrada10,00 USD / 1 M tokens5,00 USD / 1 M tokens0,75 USD / 1 M tokens
Entrada en caché1,00 USD / 1 M tokens0,50 USD / 1 M tokens0,075 USD / 1 M tokens
Escritura o almacenamiento de caché12,50 USD / 1 M tokens6,25 USD / 1 M tokens (5 min) · 10,00 USD (1 h)0,50 USD / 1 M tokens por hora de almacenamiento
Precio de salida50,00 USD / 1 M tokens25,00 USD / 1 M tokens3,75 USD / 1 M tokens
Entrada por lotes5,00 USD / 1 M tokens2,50 USD / 1 M tokens0,375 USD / 1 M tokens
Salida por lotes25,00 USD / 1 M tokens12,50 USD / 1 M tokens1,875 USD / 1 M tokens
Condiciones relevantesLas solicitudes con más de 272.000 tokens de entrada aplican multiplicadores de precio; las herramientas pueden añadir cargos por llamada.El pensamiento se factura como salida. El modo Fast cuesta el doble de la tarifa base.Precios introductorios hasta el 31 de diciembre de 2026; desde 2027 se duplican las tarifas estándar.
Disponibilidad
Canales de accesoOpenAI API · Responses, Chat Completions y BatchClaude, Claude API, AWS, Google Cloud y Microsoft FoundryGemini API · Google AI Studio · versión estable
Plataformas verificadasOpenAI APIClaude.ai · Claude Code · Claude API · Amazon Bedrock · Google Cloud · Microsoft FoundryGemini API · Google AI Studio
Verificado
Fuente primariaFicha oficial de GPT‑6 Astra ↗Ficha oficial de modelos Claude ↗Ficha oficial de Gemini 3.8 Flash ↗

i «No publicado» indica que las fuentes primarias consultadas no ofrecen ese dato. Inferama no completa huecos mediante estimaciones.

02

Ejemplo de coste comparable

Una solicitud con 1 millón de tokens de entrada y 250.000 tokens de salida, sin caché ni herramientas.

OpenAI

GPT‑6 Astra

Estándar
22,500 USD
Por lotes
11,250 USD
Anthropic

Claude Opus 5

Estándar
11,250 USD
Por lotes
5,625 USD
Google

Gemini 3.8 Flash

Estándar
1,688 USD
Por lotes
0,844 USD

i Es un ejemplo aritmético, no una estimación de coste por tarea. El razonamiento, la caché, las herramientas, los reintentos y los tramos de contexto pueden alterar la factura.

03

Cómo tomar una decisión con esta tabla

El modelo más capaz no siempre es el sistema más adecuado para un flujo concreto.

01

Filtra por requisitos duros

Descarta primero lo que no admite tu modalidad, contexto, herramienta, región o presupuesto máximo.

02

Prueba tareas propias

Compara calidad, latencia, tasa de error y recuperación con casos reales y una rúbrica estable.

03

Mide el sistema completo

Incluye llamadas a herramientas, búsquedas, caché, supervisión, reintentos y coste de corregir fallos.

04

Revisa la vigencia

Los precios y límites cambian. Comprueba la fecha y abre la fuente primaria antes de contratar o migrar.

04

Fuentes consultadas

Documentación técnica, precios, estado y transparencia de cada proveedor.