D
DEEPSEEK / deepseek-reasoner

DeepSeek R1

Modèle de raisonnement ouvert et famille de modèles distillés, pertinent pour suivre l’évolution du raisonnement vérifiable.

01 / RÉSUMÉ

L'essentiel

ORIENTATIONRaisonnement ouvert historique

Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.

CONTEXTE64.000 tokens dans l’API d’origine

Capacité d'entrée maximale une fois publiée par la source.

SORTIENon publié

Limite de génération maximale documentée.

ACCÈSAPI DeepSeek et poids

Canaux de disponibilité vérifiés.

TYPE DE MODÈLETexte et raisonnement · Code

Famille fonctionnelle principale et spécialités vérifiées.

LICENCEMIT

Conditions déclarées pour l’API, les poids ou l’auto-hébergement.

02 / FICHE TECHNIQUE

Limites et intégration

ID d’APIdeepseek-reasoner
Type de modèleTexte et raisonnement · Code
Mode d’accèsAPI et poids ouverts
LicenceMIT
DéploiementAPI, local ou cloud privé
Lancement20 ENE 2025
Date limite des connaissancesNon publié
EntréeTexte
SortieTexte
Fenêtre contextuelle64.000 tokens dans l’API d’origine
puissance maximaleNon publié
RaisonnementRaisonnement explicite
Outils publiés
Sorties structuréesNon applicable ou non publié
Traitement par lotsNon publié
Cache de promptsNon publié
Ajustement finPoids et modèles distillés téléchargeables
Plateformes vérifiéesDeepSeek API · Hugging Face
CONVIENT MIEUX À

Mathématiques, code, recherche et étude de modèles de raisonnement ouverts.

À SURVEILLER

Il s’agit d’une génération antérieure ; comparez la latence et la longueur de raisonnement avec V3.2.

03 / CAPACITÉS

Ce qu’il peut faire

01

Orientation

Mathématiques, code, recherche et étude de modèles de raisonnement ouverts.

02

Contexte

64.000 tokens dans l’API d’origine · Non publié

03

Outils et intégration

Non publié

04

Accès

API DeepSeek et poids

Modalités d’entrée
Texte
04 / TARIFS

Coût documenté

ConceptValeurUnité/état
Entrée standardNon publiéTarif API standard
Entrée en cacheNon publiéLecture de préfixes réutilisés
Écriture ou stockage de cacheNon publiéLa condition varie selon le fournisseur
Sortie standardNon publiéPeut inclure des tokens de raisonnement
Entrée par lotsNon publiéTraitement asynchrone
Sortie par lotsNon publiéTraitement asynchrone

Consultez la source primaire : l’unité de facturation dépend du type de modèle et du canal d’accès.

i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.

05 / ÉVALUATIONS

Comment lire les résultats

“

Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.

BenchmarkRésultatMétriqueSource
AIME 202479,8 %Pass@1 publiéVoir la source ↗

Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.

06 / VERSIONS

Chronologie

DeepSeek R1

Version intégrée au catalogue vérifié d’Inferama.

ANALYSE

Analyses connexes

DeepSeek R1 en production : tester le modèle de prompt sans casser l’application
ANALISIS

DeepSeek R1 en production : tester le modèle de prompt sans casser l’application

Les recommandations officielles de prompting pour DeepSeek R1 sont des hypothèses à valider dans chaque application. Ce protocole permet de comparer l’emplacement des instructions et le préfixe « <think> », en mesurant à la fois la qualité des réponses et les problèmes d’intégration.

27 sept. 2026
DeepSeek R1 vs DeepSeek V3.2 : comment choisir entre raisonnement explicite et efficacité dans un flux révisable
COMPARATIVA

DeepSeek R1 vs DeepSeek V3.2 : comment choisir entre raisonnement explicite et efficacité dans un flux révisable

Une comparaison utile entre DeepSeek R1 et DeepSeek V3.2 ne commence pas par un benchmark publié, mais par une tâche propre à l’organisation, un corpus figé et une définition explicite de l’erreur matérielle. Ce protocole permet de mesurer si la délibération supplémentaire de R1 réduit les erreurs et les revues humaines, ou si V3.2 atteint le même seuil avec moins de latence, de consommation et de complexité.

22 sept. 2026
AIME 2024 : ce que mesure un pourcentage de réussite sur 30 problèmes et pourquoi deux résultats apparemment identiques peuvent ne pas être comparables
ANALISIS

AIME 2024 : ce que mesure un pourcentage de réussite sur 30 problèmes et pourquoi deux résultats apparemment identiques peuvent ne pas être comparables

Un score AIME 2024 paraît simple, mais il peut résumer des protocoles très différents. Ce guide explique ce que représente le jeu de données, comment le résultat varie selon le nombre de tentatives, la sélection des réponses, les outils et le harnais d’évaluation, ainsi que les informations à demander avant de comparer des modèles.

22 sept. 2026
07 / SOURCES

Traçabilité