GPT‑6 Astra
- Adequa-se melhor a
- Raciocínio complexo, investigação, código, documentos e agentes com ferramentas.
- Convém monitorizar
- Preço por token mais elevado; requer permissões mínimas e revisão de ações sensíveis.
Uma leitura comum de capacidades, acesso, contexto, preço e data de verificação.
| Critério | GPT‑6 Astra | Claude Opus 5 | Gemini 3.8 Flash |
|---|---|---|---|
| Identidade e vigência | |||
| Organização | OpenAI | Anthropic | |
| ID de API | gpt-6-astra | claude-opus-5 | gemini-3.8-flash |
| Estado | Disponível | Ativo | GA estável |
| Lançamento | 3 de setembro de 2026 | 24 de julho de 2026 | 2 de setembro de 2026 |
| Data de corte do conhecimento | 30 de abril de 2026 | Maio de 2026 | Não publicado na fonte consultada |
| Perfil | Fronteira generalista | Conhecimento e código | Multimodal rápido |
| Capacidade e modalidades | |||
| Entrada | Texto · Imagem | Texto · Imagem | Texto · Imagem · Vídeo · Áudio · PDF |
| Saída | Texto | Texto | Texto |
| Janela de contexto | 1.050.000 tokens | 1.000.000 tokens | 1.048.576 tokens de entrada |
| saída máxima | 128.000 tokens | 128.000 tokens | 65.536 tokens de saída |
| Raciocínio | Esforço low, medium, high, xhigh e max | Raciocínio adaptativo · esforço configurável | Níveis low, medium e high |
| Latência relativa | Moderada; depende do esforço de raciocínio | Moderada · modo Fast disponível na API | Perfil Flash orientado para a velocidade e a eficiência |
| Ferramentas e integração | |||
| Ferramentas publicadas | Funções · Pesquisa na Web · Pesquisa em ficheiros · Intérprete de código · Shell alojada · Utilização de computador · MCP | Uso de ferramentas · Pesquisa na Web · Execução de código · Utilização de computador | Funções · Pesquisa na Web · Google Maps · Execução de código · Utilização de computador (preview) · Pesquisa em ficheiros · Contexto de URL |
| Passeios Estruturados | Compatível | Compatível | Compatível |
| Processamento em lote | Compatível · 50 % de desconto | Compatível · 50 % de desconto | Compatível · 50 % de desconto |
| Cache de prompts | Compatível | Compatível · até 90 % de poupança em leituras | Compatível |
| Ajuste fino | Não compatível | Não publicado na fonte consultada | Não publicado na fonte consultada |
| Preço padrão da API | |||
| Preço de entrada | 10,00 USD / 1 M tokens | 5,00 USD / 1 M tokens | 0,75 USD/1 milhão de tokens |
| Entrada em cache | 1,00 USD / 1 M tokens | 0,50 USD / 1 M tokens | 0,075 USD / 1 M tokens |
| Escrita ou armazenamento em cache | 12,50 USD / 1 M tokens | 6,25 USD / 1 M tokens (5 min) · 10,00 USD (1 h) | 0,50 USD / 1 M tokens por hora de armazenamento |
| Preço inicial | 50,00 USD / 1 M tokens | 25,00 USD / 1 M tokens | 3,75 USD/1 milhão de tokens |
| Entrada por lotes | 5,00 USD / 1 M tokens | 2,50 USD / 1 M tokens | 0,375 USD / 1 M tokens |
| Saída por lotes | 25,00 USD / 1 M tokens | 12,50 USD / 1 M tokens | 1,875 USD / 1 M tokens |
| Condições relevantes | Os pedidos com mais de 272.000 tokens de entrada aplicam multiplicadores de preço; as ferramentas podem acrescentar encargos por chamada. | O raciocínio é faturado como saída. O modo Fast custa o dobro da tarifa base. | Preços introdutórios até 31 de dezembro de 2026; a partir de 2027, as tarifas padrão duplicam. |
| Disponibilidade | |||
| Canais de acesso | OpenAI API · Responses, Chat Completions e Batch | Claude, Claude API, AWS, Google Cloud e Microsoft Foundry | Gemini API · Google AI Studio · versão estável |
| Plataformas verificadas | OpenAI API | Claude.ai · Claude Code · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry | Gemini API · Google AI Studio |
| Verificado | |||
| Fonte primária | Ficha oficial do GPT‑6 Astra ↗ | Ficha oficial de modelos Claude ↗ | Ficha oficial do Gemini 3.8 Flash ↗ |
i «Não publicado» indica que as fontes primárias consultadas não disponibilizam esse dado. A Inferama não preenche lacunas através de estimativas.
Um pedido com 1 milhão de tokens de entrada e 250.000 tokens de saída, sem cache nem ferramentas.
i É um exemplo aritmético, não uma estimativa de custo por tarefa. O raciocínio, a cache, as ferramentas, as tentativas repetidas e os escalões de contexto podem alterar a fatura.
O modelo mais capaz nem sempre é o sistema mais adequado para um fluxo específico.
Exclui primeiro o que não suporta a tua modalidade, contexto, ferramenta, região ou orçamento máximo.
Compara qualidade, latência, taxa de erro e recuperação com casos reais e uma grelha estável.
Inclui chamadas a ferramentas, pesquisas, cache, supervisão, tentativas repetidas e o custo de corrigir falhas.
Os preços e os limites mudam. Verifica a data e abre a fonte primária antes de contratar ou migrar.
Documentação técnica, preços, estado e transparência de cada fornecedor.