G
GOOGLE / gemini-3.8-flash

Gemini 3.8 Flash

Modelo Flash para ingeniería de software de larga duración, agentes autónomos y flujos empresariales complejos.

01 / RESUMEN

Lo esencial

ORIENTACIÓNMultimodal veloz

Uso principal declarado o inferido con cautela desde la documentación oficial.

CONTEXTO1.048.576 tokens de entrada

Capacidad máxima de entrada cuando la fuente la publica.

SALIDA65.536 tokens de salida

Límite máximo de generación documentado.

ACCESOGemini API · Google AI Studio · versión estable

Canales de disponibilidad verificados.

02 / FICHA TÉCNICA

Límites e integración

ID de APIgemini-3.8-flash
Lanzamiento2 de septiembre de 2026
Corte de conocimientoNo publicado en la fuente consultada
EntradaTexto · Imagen · Vídeo · Audio · PDF
SalidaTexto
Ventana de contexto1.048.576 tokens de entrada
Salida máxima65.536 tokens de salida
RazonamientoNiveles low, medium y high
Herramientas publicadasFunciones · Búsqueda web · Google Maps · Ejecución de código · Uso de ordenador (preview) · Búsqueda en archivos · Contexto de URL
Salidas estructuradasCompatible
Procesamiento por lotesCompatible · 50 % de descuento
Caché de promptsCompatible
Ajuste finoNo publicado en la fuente consultada
Plataformas verificadasGemini API · Google AI Studio
ENCAJA MEJOR EN

Agentes de bajo coste, software de larga duración y análisis multimodal amplio.

CONVIENE VIGILAR

El precio es introductorio y el uso de grounding puede generar cargos por consulta.

03 / CAPACIDADES

Qué puede hacer

01

Agentes autónomos

Planificación y orquestación de herramientas en objetivos de varios pasos.

02

Código

Orientado a ingeniería de software prolongada y refactorizaciones amplias.

03

Multimodalidad

Admite texto, imagen, vídeo, audio y PDF como entrada.

04

Razonamiento regulable

Ofrece niveles low, medium y high para ajustar el esfuerzo.

Modalidades de entrada
TextoImagenVídeoAudioPDF
04 / PRECIOS

Coste documentado

ConceptoValorUnidad / condición
Entrada estándar0,75 USD / 1 M tokensTarifa estándar de API
Entrada en caché0,075 USD / 1 M tokensLectura de prefijos reutilizados
Escritura o almacenamiento de caché0,50 USD / 1 M tokens por hora de almacenamientoLa condición varía según proveedor
Salida estándar3,75 USD / 1 M tokensPuede incluir tokens de razonamiento
Entrada por lotes0,375 USD / 1 M tokensProcesamiento asíncrono
Salida por lotes1,875 USD / 1 M tokensProcesamiento asíncrono

Precios introductorios hasta el 31 de diciembre de 2026; desde 2027 se duplican las tarifas estándar.

i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.

05 / EVALUACIONES

Cómo leer los resultados

Google lo describe como su modelo Flash más inteligente para código y agentes. Los precios mostrados son introductorios hasta el 31 de diciembre de 2026.

Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.

06 / VERSIONES

Cronología

Gemini 3.8 Flash

Disponibilidad general y versión estable.

Gemini 3.7 Flash

Versión anterior para código y agentes.

Gemini 3.6 Flash

Primera versión estable de la serie 3.6.

07 / FUENTES

Trazabilidad