Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
DeepSeek V4.1 Flash
Agenten, Code und offene Bereitstellung zu niedrigen Kosten.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Primäre Funktionsfamilie und verifizierte Spezialisierungen.
Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.
Limits und Integration
| API-ID | deepseek-flash |
|---|---|
| Modelltyp | Text und Begründung |
| Zugangsmodell | Kostenpflichtig proprietär |
| Lizenz | Proprietär |
| Einsatz | Gehostete API |
| Veröffentlichung | 10. SEP 2026 |
| Wissensstichtag | Nicht veröffentlicht |
| Eingang | Text · Bild |
| Ausfahrt | Text |
| Kontextfenster | 1.000.000 Tokens |
| maximale Leistung | 384.000 tokens |
| Argumentation | Modi mit und ohne Reasoning |
| Veröffentlichte Tools | Funktionen · Responses API · Chat-Präfix · FIM |
| Strukturierte Ausflüge | Unterstützt |
| Stapelverarbeitung | Nicht veröffentlicht |
| Prompt-Cache | Unterstützt |
| Feinabstimmung | Offene Gewichte |
| Verifizierte Plattformen | DeepSeek API · Hugging Face |
Agenten, Code und offene Bereitstellung zu niedrigen Kosten.
Die Ausführungsbedingungen variieren je Benchmark; vergleichen Sie nicht nur die Zahl.
Was es kann
Orientierung
Agenten, Code und offene Bereitstellung zu niedrigen Kosten.
Kontext
1.000.000 tokens · 384.000 tokens
Tools und Integration
Funktionen · Responses API · Chat-Präfix · FIM
Zugang
DeepSeek API · offene Gewichte
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | 0,30 USD / 1 M tokens (Spitzenwert) | Standardtarif der API |
| Eingabe aus dem Cache | 0,006 USD / 1 M tokens (Spitzenwert) | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | Nicht veröffentlicht | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | 1,20 USD / 1 M tokens (Spitzenwert) | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
| Batch-Ausgabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
Außerhalb der Spitzenzeiten halbieren sich die Preise; die Zeiten werden in UTC veröffentlicht.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.
| Benchmark | Ergebnis | Metrik | Quelle |
|---|---|---|---|
| GPQA Diamond | 90,9 % | Genauigkeit | Quelle öffnen ↗ |
| Terminal-Bench 2.1 | 90,6 % | Genauigkeit | Quelle öffnen ↗ |
| DeepSWE v1.1 | 74,2 % | Gelöst | Quelle öffnen ↗ |
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
DeepSeek V4.1 Flash
In den verifizierten Katalog von Inferama aufgenommene Version.
Verwandte Analysen
DeepSeek V4.1 Flash: So prüfen Sie, ob die komprimierte Cache den tatsächlichen Aufwand für einen Agenten senkt
DeepSeek zufolge verfügt V4.1 Flash über einen deutlich kleineren persistenten KV-Cache als sein Vorgänger. Diese Angabe beschreibt eine Infrastruktureigenschaft, nicht die Kosten oder die Dauer einer vollständigen Aufgabe. Diese Analyse schlägt einen kontrollierten Test vor, mit dem sich beides messen lässt.
28 Sep 2026 ↗ COMPARATIVADeepSeek V4.1 Flash + Eleven v3 im Vergleich mit Full-Duplex-Sprachsystemen: So lassen sich die Architekturen vergleichen
Eine modulare Kette aus Spracherkennung, DeepSeek V4.1 Flash und Eleven v3 ist nicht dasselbe wie ein Full-Duplex-Sprachmodell. Dieser Leitfaden schlägt vor, beide Systeme durchgängig zu vergleichen, ohne aus einzelnen Spezifikationen vorab einen Sieger abzuleiten.
26 Sep 2026 ↗ ANALISISDeepSWE v1.1: Was ein Patch misst, der seinen Verifizierer besteht – und wann sein pass@1 nicht mehr zeigt, dass der Agent die Aufgabe gelöst hat
DeepSWE v1.1 bewertet von Agenten erzeugte Codeänderungen in originären Aufgaben mit langem Bearbeitungshorizont. Das Ergebnis kann ein nützliches Signal liefern, doch eine Leaderboard-Zeile ist nur interpretierbar, wenn Harness, Fehlerpolitik, Rollouts, Verifizierer und die exakte Benchmark-Version bekannt sind. Eine Überprüfung von Epoch AI fügt eine konkrete Warnung hinzu: Manche Patches, die Tests verändern, können unter bestimmten Bedingungen einen falsch negativen Befund erhalten.
23 Sep 2026 ↗