Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
DeepSeek R1
Modèle de raisonnement ouvert et famille de modèles distillés, pertinent pour suivre l’évolution du raisonnement vérifiable.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | deepseek-reasoner |
|---|---|
| Type de modèle | Texte et raisonnement · Code |
| Mode d’accès | API et poids ouverts |
| Licence | MIT |
| Déploiement | API, local ou cloud privé |
| Lancement | 20 ENE 2025 |
| Date limite des connaissances | Non publié |
| Entrée | Texte |
| Sortie | Texte |
| Fenêtre contextuelle | 64.000 tokens dans l’API d’origine |
| puissance maximale | Non publié |
| Raisonnement | Raisonnement explicite |
| Outils publiés | |
| Sorties structurées | Non applicable ou non publié |
| Traitement par lots | Non publié |
| Cache de prompts | Non publié |
| Ajustement fin | Poids et modèles distillés téléchargeables |
| Plateformes vérifiées | DeepSeek API · Hugging Face |
Mathématiques, code, recherche et étude de modèles de raisonnement ouverts.
Il s’agit d’une génération antérieure ; comparez la latence et la longueur de raisonnement avec V3.2.
Ce qu’il peut faire
Orientation
Mathématiques, code, recherche et étude de modèles de raisonnement ouverts.
Contexte
64.000 tokens dans l’API d’origine · Non publié
Outils et intégration
Non publié
Accès
API DeepSeek et poids
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | Non publié | Tarif API standard |
| Entrée en cache | Non publié | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | Non publié | La condition varie selon le fournisseur |
| Sortie standard | Non publié | Peut inclure des tokens de raisonnement |
| Entrée par lots | Non publié | Traitement asynchrone |
| Sortie par lots | Non publié | Traitement asynchrone |
Consultez la source primaire : l’unité de facturation dépend du type de modèle et du canal d’accès.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| AIME 2024 | 79,8 % | Pass@1 publié | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
DeepSeek R1
Version intégrée au catalogue vérifié d’Inferama.
Analyses connexes
DeepSeek R1 en production : tester le modèle de prompt sans casser l’application
Les recommandations officielles de prompting pour DeepSeek R1 sont des hypothèses à valider dans chaque application. Ce protocole permet de comparer l’emplacement des instructions et le préfixe « <think> », en mesurant à la fois la qualité des réponses et les problèmes d’intégration.
27 sept. 2026 ↗ COMPARATIVADeepSeek R1 vs DeepSeek V3.2 : comment choisir entre raisonnement explicite et efficacité dans un flux révisable
Une comparaison utile entre DeepSeek R1 et DeepSeek V3.2 ne commence pas par un benchmark publié, mais par une tâche propre à l’organisation, un corpus figé et une définition explicite de l’erreur matérielle. Ce protocole permet de mesurer si la délibération supplémentaire de R1 réduit les erreurs et les revues humaines, ou si V3.2 atteint le même seuil avec moins de latence, de consommation et de complexité.
22 sept. 2026 ↗ ANALISISAIME 2024 : ce que mesure un pourcentage de réussite sur 30 problèmes et pourquoi deux résultats apparemment identiques peuvent ne pas être comparables
Un score AIME 2024 paraît simple, mais il peut résumer des protocoles très différents. Ce guide explique ce que représente le jeu de données, comment le résultat varie selon le nombre de tentatives, la sélection des réponses, les outils et le harnais d’évaluation, ainsi que les informations à demander avant de comparer des modèles.
22 sept. 2026 ↗