D
DEEPSEEK / deepseek-flash

DeepSeek V4.1 Flash

Agenten, Code und offene Bereitstellung zu niedrigen Kosten.

01 / ZUSAMMENFASSUNG

Das Wesentliche

ORIENTIERUNGEffiziente Agenten

Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.

KONTEXT1.000.000 Tokens

Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.

AUSFAHRT384.000 tokens

Dokumentierte maximale Erzeugungsgrenze.

ZUGANGDeepSeek API · offene Gewichte

Verifizierte Verfügbarkeitskanäle.

MODELLTYPText und Begründung

Primäre Funktionsfamilie und verifizierte Spezialisierungen.

LIZENZProprietär

Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.

02 / TECHNISCHES DATENBLATT

Limits und Integration

API-IDdeepseek-flash
ModelltypText und Begründung
ZugangsmodellKostenpflichtig proprietär
LizenzProprietär
EinsatzGehostete API
Veröffentlichung10. SEP 2026
WissensstichtagNicht veröffentlicht
EingangText · Bild
AusfahrtText
Kontextfenster1.000.000 Tokens
maximale Leistung384.000 tokens
ArgumentationModi mit und ohne Reasoning
Veröffentlichte ToolsFunktionen · Responses API · Chat-Präfix · FIM
Strukturierte AusflügeUnterstützt
StapelverarbeitungNicht veröffentlicht
Prompt-CacheUnterstützt
FeinabstimmungOffene Gewichte
Verifizierte PlattformenDeepSeek API · Hugging Face
EIGNET SICH BESSER FÜR

Agenten, Code und offene Bereitstellung zu niedrigen Kosten.

SOLLTE BEOBACHTET WERDEN

Die Ausführungsbedingungen variieren je Benchmark; vergleichen Sie nicht nur die Zahl.

03 / FÄHIGKEITEN

Was es kann

01

Orientierung

Agenten, Code und offene Bereitstellung zu niedrigen Kosten.

02

Kontext

1.000.000 tokens · 384.000 tokens

03

Tools und Integration

Funktionen · Responses API · Chat-Präfix · FIM

04

Zugang

DeepSeek API · offene Gewichte

Eingabemodalitäten
TextBild
04 / PREISE

Dokumentierte Kosten

KonzeptWertEinheit/Zustand
Standardeingabe0,30 USD / 1 M tokens (Spitzenwert)Standardtarif der API
Eingabe aus dem Cache0,006 USD / 1 M tokens (Spitzenwert)Lesen wiederverwendeter Präfixe
Schreiben oder Speichern im CacheNicht veröffentlichtDie Bedingung variiert je nach Anbieter
Standardausgabe1,20 USD / 1 M tokens (Spitzenwert)Kann Reasoning-Tokens enthalten
Batch-EingabeNicht veröffentlichtAsynchrone Verarbeitung
Batch-AusgabeNicht veröffentlichtAsynchrone Verarbeitung

Außerhalb der Spitzenzeiten halbieren sich die Preise; die Zeiten werden in UTC veröffentlicht.

i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.

05 / BEWERTUNGEN

So lesen Sie die Ergebnisse

“

Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.

BenchmarkErgebnisMetrikQuelle
GPQA Diamond90,9 %GenauigkeitQuelle öffnen ↗
Terminal-Bench 2.190,6 %GenauigkeitQuelle öffnen ↗
DeepSWE v1.174,2 %GelöstQuelle öffnen ↗

Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.

06 / VERSIONEN

Chronologie

DeepSeek V4.1 Flash

In den verifizierten Katalog von Inferama aufgenommene Version.

ANALYSE

Verwandte Analysen

DeepSeek V4.1 Flash: So prüfen Sie, ob die komprimierte Cache den tatsächlichen Aufwand für einen Agenten senkt
ANALISIS

DeepSeek V4.1 Flash: So prüfen Sie, ob die komprimierte Cache den tatsächlichen Aufwand für einen Agenten senkt

DeepSeek zufolge verfügt V4.1 Flash über einen deutlich kleineren persistenten KV-Cache als sein Vorgänger. Diese Angabe beschreibt eine Infrastruktureigenschaft, nicht die Kosten oder die Dauer einer vollständigen Aufgabe. Diese Analyse schlägt einen kontrollierten Test vor, mit dem sich beides messen lässt.

28 Sep 2026
DeepSeek V4.1 Flash + Eleven v3 im Vergleich mit Full-Duplex-Sprachsystemen: So lassen sich die Architekturen vergleichen
COMPARATIVA

DeepSeek V4.1 Flash + Eleven v3 im Vergleich mit Full-Duplex-Sprachsystemen: So lassen sich die Architekturen vergleichen

Eine modulare Kette aus Spracherkennung, DeepSeek V4.1 Flash und Eleven v3 ist nicht dasselbe wie ein Full-Duplex-Sprachmodell. Dieser Leitfaden schlägt vor, beide Systeme durchgängig zu vergleichen, ohne aus einzelnen Spezifikationen vorab einen Sieger abzuleiten.

26 Sep 2026
DeepSWE v1.1: Was ein Patch misst, der seinen Verifizierer besteht – und wann sein pass@1 nicht mehr zeigt, dass der Agent die Aufgabe gelöst hat
ANALISIS

DeepSWE v1.1: Was ein Patch misst, der seinen Verifizierer besteht – und wann sein pass@1 nicht mehr zeigt, dass der Agent die Aufgabe gelöst hat

DeepSWE v1.1 bewertet von Agenten erzeugte Codeänderungen in originären Aufgaben mit langem Bearbeitungshorizont. Das Ergebnis kann ein nützliches Signal liefern, doch eine Leaderboard-Zeile ist nur interpretierbar, wenn Harness, Fehlerpolitik, Rollouts, Verifizierer und die exakte Benchmark-Version bekannt sind. Eine Überprüfung von Epoch AI fügt eine konkrete Warnung hinzu: Manche Patches, die Tests verändern, können unter bestimmten Bedingungen einen falsch negativen Befund erhalten.

23 Sep 2026
07 / QUELLEN

Rückverfolgbarkeit