Uso primário declarado ou inferido com cautela a partir da documentação oficial.
Gemini 3.8 Flash
Modelo Flash para engenharia de software de longa duração, agentes autônomos e fluxos de negócios complexos.
O essencial
Capacidade máxima de entrada quando publicada pela fonte.
Limite máximo de geração documentado.
Canais de disponibilidade verificados.
Limites e integração
| ID de API | gemini-3.8-flash |
|---|---|
| Lançamento | 2 de setembro de 2026 |
| Data de corte do conhecimento | Não publicado na fonte consultada |
| Entrada | Texto · Imagem · Vídeo · Áudio · PDF |
| Saída | Texto |
| Janela de contexto | 1.048.576 tokens de entrada |
| saída máxima | 65.536 tokens de saída |
| Raciocínio | Níveis low, medium e high |
| Ferramentas publicadas | Funções · Pesquisa na Web · Google Maps · Execução de código · Utilização de computador (preview) · Pesquisa em ficheiros · Contexto de URL |
| Passeios Estruturados | Compatível |
| Processamento em lote | Compatível · 50 % de desconto |
| Cache de prompts | Compatível |
| Ajuste fino | Não publicado na fonte consultada |
| Plataformas verificadas | Gemini API · Google AI Studio |
Agentes de baixo custo, software de longa duração e análise multimodal ampla.
O preço é introdutório e a utilização de grounding pode gerar encargos por consulta.
O que pode fazer
Agentes autônomos
Planejar e orquestrar ferramentas em objetivos de várias etapas.
Código
Voltado para extensa engenharia de software e extensas refatorações.
Multimodalidade
Suporta texto, imagem, vídeo, áudio e PDF como entrada.
Raciocínio ajustável
Oferece níveis baixo, médio e alto para ajustar o esforço.
Custo documentado
| Conceito | Valor | Unidade/condição |
|---|---|---|
| Entrada padrão | 0,75 USD/1 milhão de tokens | Tarifa padrão da API |
| Entrada em cache | 0,075 USD / 1 M tokens | Leitura de prefixos reutilizados |
| Escrita ou armazenamento em cache | 0,50 USD / 1 M tokens por hora de armazenamento | A condição varia consoante o fornecedor |
| Saída padrão | 3,75 USD/1 milhão de tokens | Pode incluir tokens de raciocínio |
| Entrada por lotes | 0,375 USD / 1 M tokens | Processamento assíncrono |
| Saída por lotes | 1,875 USD / 1 M tokens | Processamento assíncrono |
Preços introdutórios até 31 de dezembro de 2026; a partir de 2027, as tarifas padrão duplicam.
i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.
Como ler os resultados
O Google o descreve como seu modelo Flash mais inteligente para código e agentes. Os preços apresentados são introdutórios até 31 de dezembro de 2026.
O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.
Cronologia
Gemini 3.8 Flash
Disponibilidade geral e versão estável.
Gemini 3.7 Flash
Versão anterior para código e agentes.
Gemini 3.6 Flash
Primeira versão estável da série 3.6.