Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
DeepSeek V4.1 Flash
Agents, code et déploiement ouvert à faible coût.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | deepseek-flash |
|---|---|
| Type de modèle | Texte et raisonnement |
| Mode d’accès | Propriétaire payant |
| Licence | Propriétaire |
| Déploiement | API hébergée |
| Lancement | 10 SEPT 2026 |
| Date limite des connaissances | Non publié |
| Entrée | Texte · Image |
| Sortie | Texte |
| Fenêtre contextuelle | 1 000 000 tokens |
| puissance maximale | 384.000 tokens |
| Raisonnement | Modes avec et sans raisonnement |
| Outils publiés | Fonctions · Responses API · Préfixe de chat · FIM |
| Sorties structurées | Pris en charge |
| Traitement par lots | Non publié |
| Cache de prompts | Pris en charge |
| Ajustement fin | Poids ouverts |
| Plateformes vérifiées | DeepSeek API · Hugging Face |
Agents, code et déploiement ouvert à faible coût.
Les conditions d’exécution varient selon les benchmarks ; ne comparez pas seulement le chiffre.
Ce qu’il peut faire
Orientation
Agents, code et déploiement ouvert à faible coût.
Contexte
1.000.000 tokens · 384.000 tokens
Outils et intégration
Fonctionnalités · Responses API · Préfixe de chat · FIM
Accès
DeepSeek API · poids ouverts
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | 0,30 USD / 1 M tokens (pic) | Tarif API standard |
| Entrée en cache | 0,006 USD / 1 M tokens (pic) | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | Non publié | La condition varie selon le fournisseur |
| Sortie standard | 1,20 USD / 1 M tokens (pic) | Peut inclure des tokens de raisonnement |
| Entrée par lots | Non publié | Traitement asynchrone |
| Sortie par lots | Non publié | Traitement asynchrone |
Les tarifs hors pointe sont réduits de moitié ; les horaires sont publiés en UTC.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| GPQA Diamond | 90,9 % | Exactitude | Voir la source ↗ |
| Terminal-Bench 2.1 | 90,6 % | Exactitude | Voir la source ↗ |
| DeepSWE v1.1 | 74,2 % | Résolu | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
DeepSeek V4.1 Flash
Version intégrée au catalogue vérifié d’Inferama.
Analyses connexes
DeepSeek V4.1 Flash : comment vérifier si son cache compressé réduit réellement le coût d’un agent
DeepSeek attribue à V4.1 Flash un cache KV persistant bien plus petit que celui de son prédécesseur. Ce chiffre décrit une propriété d’infrastructure, pas le coût ni la durée d’une tâche complète. Cette analyse propose un protocole contrôlé pour mesurer les deux.
28 sept. 2026 ↗ COMPARATIVADeepSeek V4.1 Flash + Eleven v3 face à la voix full-duplex : comment comparer les architectures
Une chaîne modulaire associant reconnaissance vocale, DeepSeek V4.1 Flash et Eleven v3 n’équivaut pas à un modèle vocal full-duplex. Ce guide propose de comparer les deux systèmes de bout en bout, sans désigner de gagnant sur la seule base de spécifications isolées.
26 sept. 2026 ↗ ANALISISDeepSWE v1.1 : ce que mesure un patch qui passe son vérificateur, et quand son pass@1 ne prouve plus que l’agent a résolu la tâche
DeepSWE v1.1 évalue des modifications de code produites par des agents sur des tâches originales et de longue haleine. Son résultat peut fournir un signal utile, mais une ligne du leaderboard n’est interprétable que si l’on connaît le harnais, la politique de traitement des erreurs, les rollouts, le vérificateur et la version exacte du benchmark. Une revue d’Epoch AI ajoute un avertissement précis : certains patchs qui modifient des tests peuvent recevoir un faux négatif dans certaines conditions.
23 sept. 2026 ↗