Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
Claude Haiku 4.5
Volume élevé, sous-agents et extraction structurée.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | claude-haiku-4-5-20251001 |
|---|---|
| Type de modèle | Texte et raisonnement |
| Mode d’accès | Propriétaire payant |
| Licence | Propriétaire |
| Déploiement | API hébergée |
| Lancement | 15 OCT 2025 |
| Date limite des connaissances | FÉV 2025 |
| Entrée | Texte · Image |
| Sortie | Texte |
| Fenêtre contextuelle | 200.000 tokens |
| puissance maximale | 64.000 tokens |
| Raisonnement | Raisonnement étendu |
| Outils publiés | Utilisation d'outils · Recherche web · Exécution de code · Utilisation d’ordinateur |
| Sorties structurées | Pris en charge |
| Traitement par lots | Compatible · 50 % de réduction |
| Cache de prompts | Compatible · jusqu’à 90 % d’économies sur les lectures |
| Ajustement fin | Non publié |
| Plateformes vérifiées | Claude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry |
Volume élevé, sous-agents et extraction structurée.
Le coût et les performances dépendent du niveau de raisonnement.
Ce qu’il peut faire
Orientation
Volume élevé, sous-agents et extraction structurée.
Contexte
200.000 tokens · 64.000 tokens
Outils et intégration
Utilisation d’outils · Recherche web · Exécution de code · Utilisation d’ordinateur
Accès
Claude, Claude API et clouds associés
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | 1,00 USD / 1 M tokens | Tarif API standard |
| Entrée en cache | 0,10 USD / 1 M tokens | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | 1,25–2,00 USD / 1 M tokens | La condition varie selon le fournisseur |
| Sortie standard | 5,00 USD / 1 M tokens | Peut inclure des tokens de raisonnement |
| Entrée par lots | 0,50 USD / 1 M tokens | Traitement asynchrone |
| Sortie par lots | 2,50 USD / 1 M tokens | Traitement asynchrone |
Consultez la source primaire avant de budgétiser un déploiement.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| SWE-bench Verified | 73,3 % | Résolu | Voir la source ↗ |
| Terminal-Bench | 41,75 % | Avec raisonnement | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
Claude Haiku 4.5
Version intégrée au catalogue vérifié d’Inferama.
Analyses connexes
Claude Haiku 4.5 : comment calculer le coût par réponse exploitable
Le tarif par appel ne suffit pas à révéler le coût d’une réponse acceptée par l’équipe. Ce guide présente une formule reproductible qui additionne les tokens d’entrée et de sortie, les nouvelles tentatives et la révision, ainsi que trois scénarios illustratifs pour Claude Haiku 4.5.
23 sept. 2026 ↗ ANALISISClaude Haiku 4.5 : exploiter une voie à faible latence après Haiku 3.5 sans confondre conservation minimale et continuité garantie
Claude Haiku 4.5 peut constituer une destination pour des charges rapides après le retrait de Claude Haiku 3.5, mais une migration sûre ne se résume pas à modifier un identifiant. La disponibilité minimale documentée jusqu'au 15 octobre 2026 ne garantit pas une pérennité indéfinie. Le critère opérationnel consiste à démontrer, avec son propre trafic et son propre corpus, la latence de file d'attente, le respect du schéma, l'utilisation des outils et une substitution réversible.
23 sept. 2026 ↗ ANALISISCoût dans SWE-bench : comment calculer le prix par incident résolu sans masquer les échecs, les nouvelles tentatives ni l’évaluation
Un chiffre de coût par incident résolu n’est utile que s’il révèle tout ce qui s’est produit avant l’obtention du correctif : tentatives échouées, consommation de tokens, règles d’arrêt, sélection entre exécutions et ressources d’évaluation. Cette analyse propose une fiche reproductible pour lire et comparer les résultats de SWE-bench, en portant une attention particulière à SWE-bench Verified.
22 sept. 2026 ↗ GUIAAnalyser les retours clients avec l’IA : transformer des milliers de commentaires en priorités sans confondre fréquence et impact
Un parcours pour les équipes produit, support et recherche qui doivent analyser des avis, tickets, enquêtes ou transcriptions avec l’IA sans faire d’un résumé automatique une décision dénuée de preuves.
22 sept. 2026 ↗ COMPARATIVAClaude Haiku 4.5 vs Claude Opus 5 : quand un surcoût peut justifier un meilleur résultat
Le choix entre Claude Haiku 4.5 et Claude Opus 5 ne devrait pas être tranché uniquement à partir des tarifs par token ou de benchmarks externes. Cette comparaison propose un protocole reproductible pour mesurer les résultats acceptés, les nouvelles tentatives, la révision humaine, la latence et le coût effectif dans la classification structurée, la synthèse documentaire et la revue technique complexe. Les sources disponibles permettent de fixer des conditions de comparabilité et des limites techniques, mais pas d’affirmer des résultats empiriques sans exécuter et publier l’essai.
22 sept. 2026 ↗ ANALISISAnthropic : comment vérifier ce qui change lorsque vous utilisez Claude via une API, un cloud partenaire ou un produit
Adopter Claude ne consiste pas seulement à choisir une famille de modèles. Le canal d’accès détermine l’identifiant utilisé, le calendrier de retrait applicable, les contrôles administrés par chaque partie et la documentation susceptible d’étayer une décision technique. Ce guide propose une méthode pour distinguer ces couches sans transformer des politiques publiques ou des évaluations de sécurité en garanties qu’elles ne contiennent pas.
22 sept. 2026 ↗