G
GOOGLE / gemini-3.8-flash

Gemini 3.8 Flash

Flash-Modell für langwieriges Software-Engineering, autonome Agenten und komplexe Geschäftsabläufe.

01 / ZUSAMMENFASSUNG

Das Wesentliche

ORIENTIERUNGSchnell multimodal

Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.

KONTEXT1.048.576 Eintrittstoken

Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.

AUSFAHRT65.536 Ausgabe-Token

Dokumentierte maximale Erzeugungsgrenze.

ZUGANGGemini API · Google AI Studio · stabile Version

Verifizierte Verfügbarkeitskanäle.

02 / TECHNISCHES DATENBLATT

Limits und Integration

API-IDgemini-3.8-flash
Veröffentlichung2. September 2026
WissensstichtagNicht in der konsultierten Quelle veröffentlicht
EingangText · Bild · Video · Audio · PDF
AusfahrtText
Kontextfenster1.048.576 Eintrittstoken
maximale Leistung65.536 Ausgabe-Token
ArgumentationStufen low, medium und high
Veröffentlichte ToolsFunktionen · Websuche · Google Maps · Codeausführung · Computernutzung (Vorschau) · Dateisuche · URL-Kontext
Strukturierte AusflügeKompatibel
StapelverarbeitungKompatibel · 50 % Rabatt
Prompt-CacheKompatibel
FeinabstimmungNicht in der konsultierten Quelle veröffentlicht
Verifizierte PlattformenGemini API · Google AI Studio
EIGNET SICH BESSER FÜR

Kostengünstige Agenten, langlebige Software und umfassende multimodale Analyse.

SOLLTE BEOBACHTET WERDEN

Der Preis ist ein Einführungspreis, und die Nutzung von Grounding kann Kosten pro Abfrage verursachen.

03 / FÄHIGKEITEN

Was es kann

01

Freiberufliche Agenten

Planung und Orchestrierung von Tools in mehrstufige Ziele.

02

Code

Ziel ist umfangreiches Software-Engineering und umfangreiche Refactorings.

03

Multimodalität

Unterstützt Text, Bild, Video, Audio und PDF als Eingabe.

04

Anpassbare Argumentation

Es bietet niedrige, mittlere und hohe Stufen zur Anpassung der Anstrengung.

Eingabemodalitäten
TextBildVideoAudioPDF
04 / PREISE

Dokumentierte Kosten

KonzeptWertEinheit/Zustand
Standardeingabe0,75 USD / 1 Mio. TokenStandardtarif der API
Eingabe aus dem Cache0,075 USD / 1 M TokensLesen wiederverwendeter Präfixe
Schreiben oder Speichern im Cache0,50 USD / 1 M Tokens pro SpeicherstundeDie Bedingung variiert je nach Anbieter
Standardausgabe3,75 USD / 1 Mio. TokenKann Reasoning-Tokens enthalten
Batch-Eingabe0,375 USD / 1 M TokensAsynchrone Verarbeitung
Batch-Ausgabe1,875 USD / 1 M TokensAsynchrone Verarbeitung

Einführungspreise bis zum 31. Dezember 2026; ab 2027 verdoppeln sich die Standardtarife.

i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.

05 / BEWERTUNGEN

So lesen Sie die Ergebnisse

Google beschreibt es als sein intelligentestes Flash-Modell für Code und Agenten. Die angezeigten Preise gelten bis zum 31. Dezember 2026 als Einführungspreise.

Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.

06 / VERSIONEN

Chronologie

Gemini 3.8 Flash

Allgemeine Verfügbarkeit und stabile Version.

Gemini 3.7 Flash

Vorherige Version für Code und Agenten.

Gemini 3.6 Flash

Erste stabile Version der Serie 3.6.

07 / QUELLEN

Rückverfolgbarkeit