G
GOOGLE / gemini-3.8-flash

Gemini 3.8 Flash

Modelo Flash para engenharia de software de longa duração, agentes autônomos e fluxos de negócios complexos.

01 / RESUMO

O essencial

ORIENTAÇÃOMultimodal rápido

Uso primário declarado ou inferido com cautela a partir da documentação oficial.

CONTEXTO1.048.576 tokens de entrada

Capacidade máxima de entrada quando publicada pela fonte.

SAÍDA65.536 tokens de saída

Limite máximo de geração documentado.

ACESSOGemini API · Google AI Studio · versão estável

Canais de disponibilidade verificados.

02 / FICHA TÉCNICA

Limites e integração

ID de APIgemini-3.8-flash
Lançamento2 de setembro de 2026
Data de corte do conhecimentoNão publicado na fonte consultada
EntradaTexto · Imagem · Vídeo · Áudio · PDF
SaídaTexto
Janela de contexto1.048.576 tokens de entrada
saída máxima65.536 tokens de saída
RaciocínioNíveis low, medium e high
Ferramentas publicadasFunções · Pesquisa na Web · Google Maps · Execução de código · Utilização de computador (preview) · Pesquisa em ficheiros · Contexto de URL
Passeios EstruturadosCompatível
Processamento em loteCompatível · 50 % de desconto
Cache de promptsCompatível
Ajuste finoNão publicado na fonte consultada
Plataformas verificadasGemini API · Google AI Studio
ADEQUA-SE MELHOR A

Agentes de baixo custo, software de longa duração e análise multimodal ampla.

CONVÉM MONITORIZAR

O preço é introdutório e a utilização de grounding pode gerar encargos por consulta.

03 / CAPACIDADES

O que pode fazer

01

Agentes autônomos

Planejar e orquestrar ferramentas em objetivos de várias etapas.

02

Código

Voltado para extensa engenharia de software e extensas refatorações.

03

Multimodalidade

Suporta texto, imagem, vídeo, áudio e PDF como entrada.

04

Raciocínio ajustável

Oferece níveis baixo, médio e alto para ajustar o esforço.

Modalidades de entrada
TextoImagemVídeoÁudioPDF
04 / PREÇOS

Custo documentado

ConceitoValorUnidade/condição
Entrada padrão0,75 USD/1 milhão de tokensTarifa padrão da API
Entrada em cache0,075 USD / 1 M tokensLeitura de prefixos reutilizados
Escrita ou armazenamento em cache0,50 USD / 1 M tokens por hora de armazenamentoA condição varia consoante o fornecedor
Saída padrão3,75 USD/1 milhão de tokensPode incluir tokens de raciocínio
Entrada por lotes0,375 USD / 1 M tokensProcessamento assíncrono
Saída por lotes1,875 USD / 1 M tokensProcessamento assíncrono

Preços introdutórios até 31 de dezembro de 2026; a partir de 2027, as tarifas padrão duplicam.

i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.

05 / AVALIAÇÕES

Como ler os resultados

O Google o descreve como seu modelo Flash mais inteligente para código e agentes. Os preços apresentados são introdutórios até 31 de dezembro de 2026.

O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.

06 / VERSÕES

Cronologia

Gemini 3.8 Flash

Disponibilidade geral e versão estável.

Gemini 3.7 Flash

Versão anterior para código e agentes.

Gemini 3.6 Flash

Primeira versão estável da série 3.6.

07 / FONTES

Rastreabilidade