Uso principal declarado o inferido con cautela desde la documentación oficial.
Gemini 3.8 Flash
Modelo Flash para ingeniería de software de larga duración, agentes autónomos y flujos empresariales complejos.
Lo esencial
Capacidad máxima de entrada cuando la fuente la publica.
Límite máximo de generación documentado.
Canales de disponibilidad verificados.
Límites e integración
| ID de API | gemini-3.8-flash |
|---|---|
| Lanzamiento | 2 de septiembre de 2026 |
| Corte de conocimiento | No publicado en la fuente consultada |
| Entrada | Texto · Imagen · Vídeo · Audio · PDF |
| Salida | Texto |
| Ventana de contexto | 1.048.576 tokens de entrada |
| Salida máxima | 65.536 tokens de salida |
| Razonamiento | Niveles low, medium y high |
| Herramientas publicadas | Funciones · Búsqueda web · Google Maps · Ejecución de código · Uso de ordenador (preview) · Búsqueda en archivos · Contexto de URL |
| Salidas estructuradas | Compatible |
| Procesamiento por lotes | Compatible · 50 % de descuento |
| Caché de prompts | Compatible |
| Ajuste fino | No publicado en la fuente consultada |
| Plataformas verificadas | Gemini API · Google AI Studio |
Agentes de bajo coste, software de larga duración y análisis multimodal amplio.
El precio es introductorio y el uso de grounding puede generar cargos por consulta.
Qué puede hacer
Agentes autónomos
Planificación y orquestación de herramientas en objetivos de varios pasos.
Código
Orientado a ingeniería de software prolongada y refactorizaciones amplias.
Multimodalidad
Admite texto, imagen, vídeo, audio y PDF como entrada.
Razonamiento regulable
Ofrece niveles low, medium y high para ajustar el esfuerzo.
Coste documentado
| Concepto | Valor | Unidad / condición |
|---|---|---|
| Entrada estándar | 0,75 USD / 1 M tokens | Tarifa estándar de API |
| Entrada en caché | 0,075 USD / 1 M tokens | Lectura de prefijos reutilizados |
| Escritura o almacenamiento de caché | 0,50 USD / 1 M tokens por hora de almacenamiento | La condición varía según proveedor |
| Salida estándar | 3,75 USD / 1 M tokens | Puede incluir tokens de razonamiento |
| Entrada por lotes | 0,375 USD / 1 M tokens | Procesamiento asíncrono |
| Salida por lotes | 1,875 USD / 1 M tokens | Procesamiento asíncrono |
Precios introductorios hasta el 31 de diciembre de 2026; desde 2027 se duplican las tarifas estándar.
i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.
Cómo leer los resultados
Google lo describe como su modelo Flash más inteligente para código y agentes. Los precios mostrados son introductorios hasta el 31 de diciembre de 2026.
Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.
Cronología
Gemini 3.8 Flash
Disponibilidad general y versión estable.
Gemini 3.7 Flash
Versión anterior para código y agentes.
Gemini 3.6 Flash
Primera versión estable de la serie 3.6.