Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
Gemini 3.8 Flash
Flash-Modell für langwieriges Software-Engineering, autonome Agenten und komplexe Geschäftsabläufe.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Limits und Integration
| API-ID | gemini-3.8-flash |
|---|---|
| Veröffentlichung | 2. September 2026 |
| Wissensstichtag | Nicht in der konsultierten Quelle veröffentlicht |
| Eingang | Text · Bild · Video · Audio · PDF |
| Ausfahrt | Text |
| Kontextfenster | 1.048.576 Eintrittstoken |
| maximale Leistung | 65.536 Ausgabe-Token |
| Argumentation | Stufen low, medium und high |
| Veröffentlichte Tools | Funktionen · Websuche · Google Maps · Codeausführung · Computernutzung (Vorschau) · Dateisuche · URL-Kontext |
| Strukturierte Ausflüge | Kompatibel |
| Stapelverarbeitung | Kompatibel · 50 % Rabatt |
| Prompt-Cache | Kompatibel |
| Feinabstimmung | Nicht in der konsultierten Quelle veröffentlicht |
| Verifizierte Plattformen | Gemini API · Google AI Studio |
Kostengünstige Agenten, langlebige Software und umfassende multimodale Analyse.
Der Preis ist ein Einführungspreis, und die Nutzung von Grounding kann Kosten pro Abfrage verursachen.
Was es kann
Freiberufliche Agenten
Planung und Orchestrierung von Tools in mehrstufige Ziele.
Code
Ziel ist umfangreiches Software-Engineering und umfangreiche Refactorings.
Multimodalität
Unterstützt Text, Bild, Video, Audio und PDF als Eingabe.
Anpassbare Argumentation
Es bietet niedrige, mittlere und hohe Stufen zur Anpassung der Anstrengung.
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | 0,75 USD / 1 Mio. Token | Standardtarif der API |
| Eingabe aus dem Cache | 0,075 USD / 1 M Tokens | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | 0,50 USD / 1 M Tokens pro Speicherstunde | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | 3,75 USD / 1 Mio. Token | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | 0,375 USD / 1 M Tokens | Asynchrone Verarbeitung |
| Batch-Ausgabe | 1,875 USD / 1 M Tokens | Asynchrone Verarbeitung |
Einführungspreise bis zum 31. Dezember 2026; ab 2027 verdoppeln sich die Standardtarife.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Google beschreibt es als sein intelligentestes Flash-Modell für Code und Agenten. Die angezeigten Preise gelten bis zum 31. Dezember 2026 als Einführungspreise.
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
Gemini 3.8 Flash
Allgemeine Verfügbarkeit und stabile Version.
Gemini 3.7 Flash
Vorherige Version für Code und Agenten.
Gemini 3.6 Flash
Erste stabile Version der Serie 3.6.