A
ANTHROPIC / claude-sonnet-5

Claude Sonnet 5

Code, recherche et flux professionnels avec outils.

01 / RÉSUMÉ

L'essentiel

ORIENTATIONÉquilibre coût/capacité

Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.

CONTEXTE1 000 000 tokens

Capacité d'entrée maximale une fois publiée par la source.

SORTIE128 000 tokens

Limite de génération maximale documentée.

ACCÈSClaude, Claude API et clouds associés

Canaux de disponibilité vérifiés.

TYPE DE MODÈLETexte et raisonnement

Famille fonctionnelle principale et spécialités vérifiées.

LICENCEPropriétaire

Conditions déclarées pour l’API, les poids ou l’auto-hébergement.

02 / FICHE TECHNIQUE

Limites et intégration

ID d’APIclaude-sonnet-5
Type de modèleTexte et raisonnement
Mode d’accèsPropriétaire payant
LicencePropriétaire
DéploiementAPI hébergée
Lancement30 JUIN 2026
Date limite des connaissancesJANV 2026
EntréeTexte · Image
SortieTexte
Fenêtre contextuelle1 000 000 tokens
puissance maximale128 000 tokens
RaisonnementRaisonnement adaptatif · effort configurable
Outils publiésUtilisation d'outils · Recherche web · Exécution de code · Utilisation d’ordinateur
Sorties structuréesPris en charge
Traitement par lotsCompatible · 50 % de réduction
Cache de promptsCompatible · jusqu’à 90 % d’économies sur les lectures
Ajustement finNon publié
Plateformes vérifiéesClaude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry
CONVIENT MIEUX À

Code, recherche et flux professionnels avec outils.

À SURVEILLER

Le coût et les performances dépendent du niveau de raisonnement.

03 / CAPACITÉS

Ce qu’il peut faire

01

Orientation

Code, recherche et flux professionnels avec outils.

02

Contexte

1.000.000 tokens · 128.000 tokens

03

Outils et intégration

Utilisation d’outils · Recherche web · Exécution de code · Utilisation d’ordinateur

04

Accès

Claude, Claude API et clouds associés

Modalités d’entrée
TexteImage
04 / TARIFS

Coût documenté

ConceptValeurUnité/état
Entrée standard2,00 USD / 1 M tokensTarif API standard
Entrée en cache0,20 USD / 1 M tokensLecture de préfixes réutilisés
Écriture ou stockage de cache2,50–4,00 USD / 1 M tokensLa condition varie selon le fournisseur
Sortie standard10,00 USD / 1 M tokensPeut inclure des tokens de raisonnement
Entrée par lots1,00 USD / 1 M tokensTraitement asynchrone
Sortie par lots5,00 USD / 1 M tokensTraitement asynchrone

Consultez la source primaire avant de budgétiser un déploiement.

i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.

05 / ÉVALUATIONS

Comment lire les résultats

“

Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.

BenchmarkRésultatMétriqueSource
OSWorld-VerifiedCourbe selon l’effortRéussite et coûtVoir la source ↗
BrowseCompCourbe selon l’effortExactitude et coûtVoir la source ↗

Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.

06 / VERSIONS

Chronologie

Claude Sonnet 5

Version intégrée au catalogue vérifié d’Inferama.

ANALYSE

Analyses connexes

Claude Sonnet 5 : mesurer l’effet de son nouveau tokenizer avant de migrer
ANALISIS

Claude Sonnet 5 : mesurer l’effet de son nouveau tokenizer avant de migrer

Anthropic indique qu’un même texte peut être converti en davantage de tokens avec Sonnet 5 qu’avec Sonnet 4.6. Un protocole fondé sur votre propre corpus permet de vérifier si cela réduit le contexte utile ou modifie le coût par tâche dans une intégration donnée.

23 sept. 2026
BrowseComp : ce que mesure un agent qui trouve une information difficile sur le web, et pourquoi sa réussite ne prouve pas qu’il mène une recherche fiable
ANALISIS

BrowseComp : ce que mesure un agent qui trouve une information difficile sur le web, et pourquoi sa réussite ne prouve pas qu’il mène une recherche fiable

BrowseComp évalue la capacité d’un agent à localiser une réponse factuelle brève, difficile à trouver, au moyen d’une navigation web persistante. C’est un signal utile, mais limité : un score élevé ne suffit pas à attester la qualité de la recherche, la traçabilité des sources ou la fiabilité dans des tâches ouvertes.

22 sept. 2026
Claude Sonnet 5 et Cohere Embed 4 en RAG multimodal : comment distinguer une défaillance de récupération d’une défaillance de réponse
COMPARATIVA

Claude Sonnet 5 et Cohere Embed 4 en RAG multimodal : comment distinguer une défaillance de récupération d’une défaillance de réponse

Claude Sonnet 5 et Cohere Embed 4 interviennent à des couches différentes d’un système RAG multimodal. Ce guide propose une expérience factorielle, sur un corpus et des conditions figés, afin de mesurer séparément si les bonnes preuves ont été récupérées et si la réponse les exploite fidèlement.

22 sept. 2026
Claude Fable 5.1 : quand le cache et le traitement par lots réduisent le coût par tâche — et quand ils ne font que déplacer la facture
GUIA

Claude Fable 5.1 : quand le cache et le traitement par lots réduisent le coût par tâche — et quand ils ne font que déplacer la facture

Le tarif par million de tokens ne suffit pas pour choisir entre un appel standard, le cache d’instructions ou le traitement par lots. Ce guide propose un modèle de coût par tâche correctement achevée pour Claude Fable 5.1, avec des formules, des scénarios et une télémétrie minimale. Le résultat dépend de la réutilisation du contexte avant son expiration, de la maîtrise des nouvelles tentatives et de l’acceptation — ou non — du délai asynchrone de Batch API.

22 sept. 2026
Anthropic : comment vérifier ce qui change lorsque vous utilisez Claude via une API, un cloud partenaire ou un produit
ANALISIS

Anthropic : comment vérifier ce qui change lorsque vous utilisez Claude via une API, un cloud partenaire ou un produit

Adopter Claude ne consiste pas seulement à choisir une famille de modèles. Le canal d’accès détermine l’identifiant utilisé, le calendrier de retrait applicable, les contrôles administrés par chaque partie et la documentation susceptible d’étayer une décision technique. Ce guide propose une méthode pour distinguer ces couches sans transformer des politiques publiques ou des évaluations de sécurité en garanties qu’elles ne contiennent pas.

22 sept. 2026
07 / SOURCES

Traçabilité