Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
DeepSeek R1
Offenes Reasoning-Modell und Familie destillierter Modelle, relevant für die Beobachtung der Entwicklung überprüfbaren Reasonings.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Primäre Funktionsfamilie und verifizierte Spezialisierungen.
Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.
Limits und Integration
| API-ID | deepseek-reasoner |
|---|---|
| Modelltyp | Text und Begründung · Code |
| Zugangsmodell | API und offene Gewichte |
| Lizenz | MIT |
| Einsatz | API, lokal oder private Cloud |
| Veröffentlichung | 20 ENE 2025 |
| Wissensstichtag | Nicht veröffentlicht |
| Eingang | Text |
| Ausfahrt | Text |
| Kontextfenster | 64.000 Tokens in der ursprünglichen API |
| maximale Leistung | Nicht veröffentlicht |
| Argumentation | Explizites Reasoning |
| Veröffentlichte Tools | |
| Strukturierte Ausflüge | Nicht zutreffend oder nicht veröffentlicht |
| Stapelverarbeitung | Nicht veröffentlicht |
| Prompt-Cache | Nicht veröffentlicht |
| Feinabstimmung | Herunterladbare Gewichte und Destillate |
| Verifizierte Plattformen | DeepSeek API · Hugging Face |
Mathematik, Code, Forschung und Untersuchung offener Reasoning-Modelle.
Es handelt sich um eine frühere Generation; vergleiche Latenz und Länge der Schlussfolgerung mit V3.2.
Was es kann
Orientierung
Mathematik, Code, Forschung und Untersuchung offener Reasoning-Modelle.
Kontext
64.000 Tokens in der ursprünglichen API · Nicht veröffentlicht
Tools und Integration
Nicht veröffentlicht
Zugang
DeepSeek API und Gewichte
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | Nicht veröffentlicht | Standardtarif der API |
| Eingabe aus dem Cache | Nicht veröffentlicht | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | Nicht veröffentlicht | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | Nicht veröffentlicht | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
| Batch-Ausgabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
Siehe die Primärquelle: Die Abrechnungseinheit hängt vom Modelltyp und Zugangsweg ab.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.
| Benchmark | Ergebnis | Metrik | Quelle |
|---|---|---|---|
| AIME 2024 | 79,8 % | Veröffentlichtes Pass@1 | Quelle öffnen ↗ |
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
DeepSeek R1
In den verifizierten Katalog von Inferama aufgenommene Version.
Verwandte Analysen
DeepSeek R1 in der Produktion: So testen Sie Prompt-Vorlagen, ohne Ihre Anwendung zu beschädigen
Die offiziellen Prompting-Empfehlungen für DeepSeek R1 sind Hypothesen, die Sie für jede Anwendung überprüfen sollten. Mit diesem Protokoll vergleichen Sie die Position von Anweisungen und das Präfix „<think>“ und messen dabei sowohl die Antwortqualität als auch Integrationsfehler.
27 Sep 2026 ↗ COMPARATIVADeepSeek R1 vs. DeepSeek V3.2: Wie Sie zwischen explizitem Reasoning und Effizienz in einem überprüfbaren Workflow entscheiden
Ein sinnvoller Vergleich von DeepSeek R1 und DeepSeek V3.2 beginnt nicht mit einem veröffentlichten Benchmark, sondern mit einer eigenen Aufgabe, einem eingefrorenen Korpus und einer expliziten Definition wesentlicher Fehler. Dieses Protokoll zeigt, wie sich messen lässt, ob die zusätzliche Deliberation von R1 Fehler und menschliche Nacharbeit senkt oder ob V3.2 denselben Schwellenwert mit geringerer Latenz, geringerem Verbrauch und weniger Integrationsaufwand erreicht.
22 Sep 2026 ↗ ANALISISAIME 2024: Was eine Trefferquote bei 30 Aufgaben misst – und warum zwei scheinbar gleiche Ergebnisse nicht vergleichbar sein können
Eine AIME-2024-Zahl wirkt einfach, kann jedoch sehr unterschiedliche Protokolle zusammenfassen. Dieser Leitfaden erklärt, was der Datensatz repräsentiert, wie Anzahl der Versuche, Antwortauswahl, Tools und Evaluierungs-Harness das Ergebnis verändern und welche Angaben vor einem Modellvergleich erforderlich sind.
22 Sep 2026 ↗