Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
Claude Sonnet 5
Code, recherche et flux professionnels avec outils.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | claude-sonnet-5 |
|---|---|
| Type de modèle | Texte et raisonnement |
| Mode d’accès | Propriétaire payant |
| Licence | Propriétaire |
| Déploiement | API hébergée |
| Lancement | 30 JUIN 2026 |
| Date limite des connaissances | JANV 2026 |
| Entrée | Texte · Image |
| Sortie | Texte |
| Fenêtre contextuelle | 1 000 000 tokens |
| puissance maximale | 128 000 tokens |
| Raisonnement | Raisonnement adaptatif · effort configurable |
| Outils publiés | Utilisation d'outils · Recherche web · Exécution de code · Utilisation d’ordinateur |
| Sorties structurées | Pris en charge |
| Traitement par lots | Compatible · 50 % de réduction |
| Cache de prompts | Compatible · jusqu’à 90 % d’économies sur les lectures |
| Ajustement fin | Non publié |
| Plateformes vérifiées | Claude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry |
Code, recherche et flux professionnels avec outils.
Le coût et les performances dépendent du niveau de raisonnement.
Ce qu’il peut faire
Orientation
Code, recherche et flux professionnels avec outils.
Contexte
1.000.000 tokens · 128.000 tokens
Outils et intégration
Utilisation d’outils · Recherche web · Exécution de code · Utilisation d’ordinateur
Accès
Claude, Claude API et clouds associés
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | 2,00 USD / 1 M tokens | Tarif API standard |
| Entrée en cache | 0,20 USD / 1 M tokens | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | 2,50–4,00 USD / 1 M tokens | La condition varie selon le fournisseur |
| Sortie standard | 10,00 USD / 1 M tokens | Peut inclure des tokens de raisonnement |
| Entrée par lots | 1,00 USD / 1 M tokens | Traitement asynchrone |
| Sortie par lots | 5,00 USD / 1 M tokens | Traitement asynchrone |
Consultez la source primaire avant de budgétiser un déploiement.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| OSWorld-Verified | Courbe selon l’effort | Réussite et coût | Voir la source ↗ |
| BrowseComp | Courbe selon l’effort | Exactitude et coût | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
Claude Sonnet 5
Version intégrée au catalogue vérifié d’Inferama.
Analyses connexes
Claude Sonnet 5 : mesurer l’effet de son nouveau tokenizer avant de migrer
Anthropic indique qu’un même texte peut être converti en davantage de tokens avec Sonnet 5 qu’avec Sonnet 4.6. Un protocole fondé sur votre propre corpus permet de vérifier si cela réduit le contexte utile ou modifie le coût par tâche dans une intégration donnée.
23 sept. 2026 ↗ ANALISISBrowseComp : ce que mesure un agent qui trouve une information difficile sur le web, et pourquoi sa réussite ne prouve pas qu’il mène une recherche fiable
BrowseComp évalue la capacité d’un agent à localiser une réponse factuelle brève, difficile à trouver, au moyen d’une navigation web persistante. C’est un signal utile, mais limité : un score élevé ne suffit pas à attester la qualité de la recherche, la traçabilité des sources ou la fiabilité dans des tâches ouvertes.
22 sept. 2026 ↗ COMPARATIVAClaude Sonnet 5 et Cohere Embed 4 en RAG multimodal : comment distinguer une défaillance de récupération d’une défaillance de réponse
Claude Sonnet 5 et Cohere Embed 4 interviennent à des couches différentes d’un système RAG multimodal. Ce guide propose une expérience factorielle, sur un corpus et des conditions figés, afin de mesurer séparément si les bonnes preuves ont été récupérées et si la réponse les exploite fidèlement.
22 sept. 2026 ↗ GUIAClaude Fable 5.1 : quand le cache et le traitement par lots réduisent le coût par tâche — et quand ils ne font que déplacer la facture
Le tarif par million de tokens ne suffit pas pour choisir entre un appel standard, le cache d’instructions ou le traitement par lots. Ce guide propose un modèle de coût par tâche correctement achevée pour Claude Fable 5.1, avec des formules, des scénarios et une télémétrie minimale. Le résultat dépend de la réutilisation du contexte avant son expiration, de la maîtrise des nouvelles tentatives et de l’acceptation — ou non — du délai asynchrone de Batch API.
22 sept. 2026 ↗ ANALISISAnthropic : comment vérifier ce qui change lorsque vous utilisez Claude via une API, un cloud partenaire ou un produit
Adopter Claude ne consiste pas seulement à choisir une famille de modèles. Le canal d’accès détermine l’identifiant utilisé, le calendrier de retrait applicable, les contrôles administrés par chaque partie et la documentation susceptible d’étayer une décision technique. Ce guide propose une méthode pour distinguer ces couches sans transformer des politiques publiques ou des évaluations de sécurité en garanties qu’elles ne contiennent pas.
22 sept. 2026 ↗