D
DEEPSEEK / deepseek-reasoner

DeepSeek R1

Offenes Reasoning-Modell und Familie destillierter Modelle, relevant für die Beobachtung der Entwicklung überprüfbaren Reasonings.

01 / ZUSAMMENFASSUNG

Das Wesentliche

ORIENTIERUNGHistorisches offenes Reasoning

Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.

KONTEXT64.000 Tokens in der ursprünglichen API

Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.

AUSFAHRTNicht veröffentlicht

Dokumentierte maximale Erzeugungsgrenze.

ZUGANGDeepSeek API und Gewichte

Verifizierte Verfügbarkeitskanäle.

MODELLTYPText und Begründung · Code

Primäre Funktionsfamilie und verifizierte Spezialisierungen.

LIZENZMIT

Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.

02 / TECHNISCHES DATENBLATT

Limits und Integration

API-IDdeepseek-reasoner
ModelltypText und Begründung · Code
ZugangsmodellAPI und offene Gewichte
LizenzMIT
EinsatzAPI, lokal oder private Cloud
Veröffentlichung20 ENE 2025
WissensstichtagNicht veröffentlicht
EingangText
AusfahrtText
Kontextfenster64.000 Tokens in der ursprünglichen API
maximale LeistungNicht veröffentlicht
ArgumentationExplizites Reasoning
Veröffentlichte Tools
Strukturierte AusflügeNicht zutreffend oder nicht veröffentlicht
StapelverarbeitungNicht veröffentlicht
Prompt-CacheNicht veröffentlicht
FeinabstimmungHerunterladbare Gewichte und Destillate
Verifizierte PlattformenDeepSeek API · Hugging Face
EIGNET SICH BESSER FÜR

Mathematik, Code, Forschung und Untersuchung offener Reasoning-Modelle.

SOLLTE BEOBACHTET WERDEN

Es handelt sich um eine frühere Generation; vergleiche Latenz und Länge der Schlussfolgerung mit V3.2.

03 / FÄHIGKEITEN

Was es kann

01

Orientierung

Mathematik, Code, Forschung und Untersuchung offener Reasoning-Modelle.

02

Kontext

64.000 Tokens in der ursprünglichen API · Nicht veröffentlicht

03

Tools und Integration

Nicht veröffentlicht

04

Zugang

DeepSeek API und Gewichte

Eingabemodalitäten
Text
04 / PREISE

Dokumentierte Kosten

KonzeptWertEinheit/Zustand
StandardeingabeNicht veröffentlichtStandardtarif der API
Eingabe aus dem CacheNicht veröffentlichtLesen wiederverwendeter Präfixe
Schreiben oder Speichern im CacheNicht veröffentlichtDie Bedingung variiert je nach Anbieter
StandardausgabeNicht veröffentlichtKann Reasoning-Tokens enthalten
Batch-EingabeNicht veröffentlichtAsynchrone Verarbeitung
Batch-AusgabeNicht veröffentlichtAsynchrone Verarbeitung

Siehe die Primärquelle: Die Abrechnungseinheit hängt vom Modelltyp und Zugangsweg ab.

i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.

05 / BEWERTUNGEN

So lesen Sie die Ergebnisse

“

Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.

BenchmarkErgebnisMetrikQuelle
AIME 202479,8 %Veröffentlichtes Pass@1Quelle öffnen ↗

Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.

06 / VERSIONEN

Chronologie

DeepSeek R1

In den verifizierten Katalog von Inferama aufgenommene Version.

ANALYSE

Verwandte Analysen

DeepSeek R1 in der Produktion: So testen Sie Prompt-Vorlagen, ohne Ihre Anwendung zu beschädigen
ANALISIS

DeepSeek R1 in der Produktion: So testen Sie Prompt-Vorlagen, ohne Ihre Anwendung zu beschädigen

Die offiziellen Prompting-Empfehlungen für DeepSeek R1 sind Hypothesen, die Sie für jede Anwendung überprüfen sollten. Mit diesem Protokoll vergleichen Sie die Position von Anweisungen und das Präfix „<think>“ und messen dabei sowohl die Antwortqualität als auch Integrationsfehler.

27 Sep 2026
DeepSeek R1 vs. DeepSeek V3.2: Wie Sie zwischen explizitem Reasoning und Effizienz in einem überprüfbaren Workflow entscheiden
COMPARATIVA

DeepSeek R1 vs. DeepSeek V3.2: Wie Sie zwischen explizitem Reasoning und Effizienz in einem überprüfbaren Workflow entscheiden

Ein sinnvoller Vergleich von DeepSeek R1 und DeepSeek V3.2 beginnt nicht mit einem veröffentlichten Benchmark, sondern mit einer eigenen Aufgabe, einem eingefrorenen Korpus und einer expliziten Definition wesentlicher Fehler. Dieses Protokoll zeigt, wie sich messen lässt, ob die zusätzliche Deliberation von R1 Fehler und menschliche Nacharbeit senkt oder ob V3.2 denselben Schwellenwert mit geringerer Latenz, geringerem Verbrauch und weniger Integrationsaufwand erreicht.

22 Sep 2026
AIME 2024: Was eine Trefferquote bei 30 Aufgaben misst – und warum zwei scheinbar gleiche Ergebnisse nicht vergleichbar sein können
ANALISIS

AIME 2024: Was eine Trefferquote bei 30 Aufgaben misst – und warum zwei scheinbar gleiche Ergebnisse nicht vergleichbar sein können

Eine AIME-2024-Zahl wirkt einfach, kann jedoch sehr unterschiedliche Protokolle zusammenfassen. Dieser Leitfaden erklärt, was der Datensatz repräsentiert, wie Anzahl der Versuche, Antwortauswahl, Tools und Evaluierungs-Harness das Ergebnis verändern und welche Angaben vor einem Modellvergleich erforderlich sind.

22 Sep 2026
07 / QUELLEN

Rückverfolgbarkeit