GPT‑6 Astra
- Encaja mejor en
- Razonamiento complejo, investigación, código, documentos y agentes con herramientas.
- Conviene vigilar
- Mayor precio por token; requiere permisos mínimos y revisión en acciones sensibles.
Una lectura común de capacidades, acceso, contexto, precio y fecha de verificación.
| Criterio | GPT‑6 Astra | Claude Opus 5 | Gemini 3.8 Flash |
|---|---|---|---|
| Identidad y vigencia | |||
| Organización | OpenAI | Anthropic | |
| ID de API | gpt-6-astra | claude-opus-5 | gemini-3.8-flash |
| Estado | Disponible | Activo | Estable · GA |
| Lanzamiento | 3 de septiembre de 2026 | 24 de julio de 2026 | 2 de septiembre de 2026 |
| Corte de conocimiento | 30 de abril de 2026 | Mayo de 2026 | No publicado en la fuente consultada |
| Perfil | Frontera generalista | Conocimiento y código | Multimodal veloz |
| Capacidad y modalidades | |||
| Entrada | Texto · Imagen | Texto · Imagen | Texto · Imagen · Vídeo · Audio · PDF |
| Salida | Texto | Texto | Texto |
| Ventana de contexto | 1.050.000 tokens | 1.000.000 tokens | 1.048.576 tokens de entrada |
| Salida máxima | 128.000 tokens | 128.000 tokens | 65.536 tokens de salida |
| Razonamiento | Esfuerzo low, medium, high, xhigh y max | Pensamiento adaptativo · esfuerzo configurable | Niveles low, medium y high |
| Latencia relativa | Moderada; depende del esfuerzo de razonamiento | Moderada · modo Fast disponible en la API | Perfil Flash orientado a velocidad y eficiencia |
| Herramientas e integración | |||
| Herramientas publicadas | Funciones · Búsqueda web · Búsqueda en archivos · Intérprete de código · Shell alojado · Uso de ordenador · MCP | Uso de herramientas · Búsqueda web · Ejecución de código · Uso de ordenador | Funciones · Búsqueda web · Google Maps · Ejecución de código · Uso de ordenador (preview) · Búsqueda en archivos · Contexto de URL |
| Salidas estructuradas | Compatible | Compatible | Compatible |
| Procesamiento por lotes | Compatible · 50 % de descuento | Compatible · 50 % de descuento | Compatible · 50 % de descuento |
| Caché de prompts | Compatible | Compatible · hasta 90 % de ahorro en lecturas | Compatible |
| Ajuste fino | No compatible | No publicado en la fuente consultada | No publicado en la fuente consultada |
| Precio estándar de API | |||
| Precio de entrada | 10,00 USD / 1 M tokens | 5,00 USD / 1 M tokens | 0,75 USD / 1 M tokens |
| Entrada en caché | 1,00 USD / 1 M tokens | 0,50 USD / 1 M tokens | 0,075 USD / 1 M tokens |
| Escritura o almacenamiento de caché | 12,50 USD / 1 M tokens | 6,25 USD / 1 M tokens (5 min) · 10,00 USD (1 h) | 0,50 USD / 1 M tokens por hora de almacenamiento |
| Precio de salida | 50,00 USD / 1 M tokens | 25,00 USD / 1 M tokens | 3,75 USD / 1 M tokens |
| Entrada por lotes | 5,00 USD / 1 M tokens | 2,50 USD / 1 M tokens | 0,375 USD / 1 M tokens |
| Salida por lotes | 25,00 USD / 1 M tokens | 12,50 USD / 1 M tokens | 1,875 USD / 1 M tokens |
| Condiciones relevantes | Las solicitudes con más de 272.000 tokens de entrada aplican multiplicadores de precio; las herramientas pueden añadir cargos por llamada. | El pensamiento se factura como salida. El modo Fast cuesta el doble de la tarifa base. | Precios introductorios hasta el 31 de diciembre de 2026; desde 2027 se duplican las tarifas estándar. |
| Disponibilidad | |||
| Canales de acceso | OpenAI API · Responses, Chat Completions y Batch | Claude, Claude API, AWS, Google Cloud y Microsoft Foundry | Gemini API · Google AI Studio · versión estable |
| Plataformas verificadas | OpenAI API | Claude.ai · Claude Code · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry | Gemini API · Google AI Studio |
| Verificado | |||
| Fuente primaria | Ficha oficial de GPT‑6 Astra ↗ | Ficha oficial de modelos Claude ↗ | Ficha oficial de Gemini 3.8 Flash ↗ |
i «No publicado» indica que las fuentes primarias consultadas no ofrecen ese dato. Inferama no completa huecos mediante estimaciones.
Una solicitud con 1 millón de tokens de entrada y 250.000 tokens de salida, sin caché ni herramientas.
i Es un ejemplo aritmético, no una estimación de coste por tarea. El razonamiento, la caché, las herramientas, los reintentos y los tramos de contexto pueden alterar la factura.
El modelo más capaz no siempre es el sistema más adecuado para un flujo concreto.
Descarta primero lo que no admite tu modalidad, contexto, herramienta, región o presupuesto máximo.
Compara calidad, latencia, tasa de error y recuperación con casos reales y una rúbrica estable.
Incluye llamadas a herramientas, búsquedas, caché, supervisión, reintentos y coste de corregir fallos.
Los precios y límites cambian. Comprueba la fecha y abre la fuente primaria antes de contratar o migrar.
Documentación técnica, precios, estado y transparencia de cada proveedor.