VERIFIZIERTE ORGANISATION

DeepSeek

Entdecke die dokumentierten Modelle, veröffentlichten Bewertungen und Primärquellen dieser Organisation.

01 / MODELLE

Verifizierter Katalog

02 / BEWERTUNGEN

Veröffentlichte Ergebnisse

Die Zahlen werden mit dem von der Quelle angegebenen Kontext dargestellt. Ein Anbieterergebnis ist kein unabhängiger Vergleich und ersetzt keine eigene Bewertung.

ModellBenchmarkErgebnisMetrik
DeepSeek V4.1 FlashGPQA Diamond90,9 %Genauigkeit
DeepSeek V4.1 FlashTerminal-Bench 2.190,6 %Genauigkeit
DeepSeek V4.1 FlashDeepSWE v1.174,2 %Gelöst
DeepSeek V3.2Evaluaciones DeepSeek V3.2Veröffentlichtes GPT‑5-NiveauReasoning und Agenten
DeepSeek R1AIME 202479,8 %Veröffentlichtes Pass@1
03 / VERFAHREN

So liest du das Verzeichnis

Eine Organisation, ein Produkt und ein Modell sind nicht dieselbe Einheit. Inferama trennt sie, um Fähigkeiten oder kommerzielle Bedingungen nicht dem falschen Element zuzuschreiben.

01

Labor

Organisation, die das Modell entwickelt oder veröffentlicht und dessen technische und Sicherheitsdokumentation pflegt.

02

Modell

Identifizierbare Version mit Limits, Modalitäten und Verhalten, die sich zwischen Veröffentlichungen ändern können.

03

Zugangskanal

API, Anwendung, angebundene Cloud oder kommerzieller Tarif; jeder Kanal kann unterschiedliche Preise, Aufbewahrungsfristen und Limits haben.

04

Quelle und Datum

Zu jeder Aussage müssen die konsultierte offizielle Seite und das Prüfdatum festgehalten werden.

ANALYSE

Verwandte Analysen

DeepSeek V4.1 Flash: So prüfen Sie, ob die komprimierte Cache den tatsächlichen Aufwand für einen Agenten senkt
ANALISIS

DeepSeek V4.1 Flash: So prüfen Sie, ob die komprimierte Cache den tatsächlichen Aufwand für einen Agenten senkt

DeepSeek zufolge verfügt V4.1 Flash über einen deutlich kleineren persistenten KV-Cache als sein Vorgänger. Diese Angabe beschreibt eine Infrastruktureigenschaft, nicht die Kosten oder die Dauer einer vollständigen Aufgabe. Diese Analyse schlägt einen kontrollierten Test vor, mit dem sich beides messen lässt.

28 Sep 2026
DeepSeek V3.2 mit Tools: So prüfen Sie den Reasoning-Zustand, bevor Sie einen Agenten weiterbetreiben oder migrieren
ANALISIS

DeepSeek V3.2 mit Tools: So prüfen Sie den Reasoning-Zustand, bevor Sie einen Agenten weiterbetreiben oder migrieren

Ein praxisorientierter Leitfaden, um zu prüfen, ob eine Integration den erforderlichen Zustand zwischen DeepSeek, Tools und Nutzenden korrekt erhält. Mit reproduzierbaren Tests, Kriterien für die Protokollierung und klaren Grenzen dessen, was sich aus `reasoning_content` ableiten lässt.

28 Sep 2026
DeepSeek R1 in der Produktion: So testen Sie Prompt-Vorlagen, ohne Ihre Anwendung zu beschädigen
ANALISIS

DeepSeek R1 in der Produktion: So testen Sie Prompt-Vorlagen, ohne Ihre Anwendung zu beschädigen

Die offiziellen Prompting-Empfehlungen für DeepSeek R1 sind Hypothesen, die Sie für jede Anwendung überprüfen sollten. Mit diesem Protokoll vergleichen Sie die Position von Anweisungen und das Präfix „<think>“ und messen dabei sowohl die Antwortqualität als auch Integrationsfehler.

27 Sep 2026
DeepSeek V4.1 Flash + Eleven v3 im Vergleich mit Full-Duplex-Sprachsystemen: So lassen sich die Architekturen vergleichen
COMPARATIVA

DeepSeek V4.1 Flash + Eleven v3 im Vergleich mit Full-Duplex-Sprachsystemen: So lassen sich die Architekturen vergleichen

Eine modulare Kette aus Spracherkennung, DeepSeek V4.1 Flash und Eleven v3 ist nicht dasselbe wie ein Full-Duplex-Sprachmodell. Dieser Leitfaden schlägt vor, beide Systeme durchgängig zu vergleichen, ohne aus einzelnen Spezifikationen vorab einen Sieger abzuleiten.

26 Sep 2026
DeepSWE v1.1: Was ein Patch misst, der seinen Verifizierer besteht – und wann sein pass@1 nicht mehr zeigt, dass der Agent die Aufgabe gelöst hat
ANALISIS

DeepSWE v1.1: Was ein Patch misst, der seinen Verifizierer besteht – und wann sein pass@1 nicht mehr zeigt, dass der Agent die Aufgabe gelöst hat

DeepSWE v1.1 bewertet von Agenten erzeugte Codeänderungen in originären Aufgaben mit langem Bearbeitungshorizont. Das Ergebnis kann ein nützliches Signal liefern, doch eine Leaderboard-Zeile ist nur interpretierbar, wenn Harness, Fehlerpolitik, Rollouts, Verifizierer und die exakte Benchmark-Version bekannt sind. Eine Überprüfung von Epoch AI fügt eine konkrete Warnung hinzu: Manche Patches, die Tests verändern, können unter bestimmten Bedingungen einen falsch negativen Befund erhalten.

23 Sep 2026
DeepSeek: Wie Sie zwischen offizieller API, veröffentlichten Gewichten und externen Anbietern entscheiden, ohne Offenheit mit operativer Kontrolle zu verwechseln
ANALISIS

DeepSeek: Wie Sie zwischen offizieller API, veröffentlichten Gewichten und externen Anbietern entscheiden, ohne Offenheit mit operativer Kontrolle zu verwechseln

Die Verfügbarkeit von Gewichten, einer kompatiblen API oder eines Familiennamens löst für sich genommen keine Produktionsentscheidung. Diese Analyse trennt Artefakt, Lizenz, Endpoint, Betreiber und Nachweise, um DeepSeek über die offizielle API, eigene Infrastruktur oder einen externen Anbieter zu bewerten.

22 Sep 2026
04 / QUELLEN

Rückverfolgbarkeit