COÛT/CAPACITÉ

Prix ​​et limites, avec date.

Le coût publié n'est comparable que lorsque l'on connaît l'unité, la modalité et les conditions.

01

Données publiées

USD par million de jetons lorsque la source utilise cette unité.

OpenAI

GPT‑6 Astra

Entrée standard
10,00 USD / 1 M tokens
Sortie standard
50,00 USD / 1 M tokens
Entrée en cache
1,00 USD / 1 M tokens
Entrée par lots
5,00 USD / 1 M tokens
Sortie par lots
25,00 USD / 1 M tokens
Contexte
1 050 000 tokens
puissance maximale
128 000 tokens

Les requêtes comportant plus de 272 000 tokens d’entrée appliquent des multiplicateurs tarifaires ; les outils peuvent ajouter des frais par appel.

Ouvrir la fiche et les sources →
Anthropic

Claude Opus 5

Entrée standard
5,00 USD / 1 M tokens
Sortie standard
25,00 USD / 1 M tokens
Entrée en cache
0,50 USD / 1 M tokens
Entrée par lots
2,50 USD / 1 M tokens
Sortie par lots
12,50 USD / 1 M tokens
Contexte
1 000 000 tokens
puissance maximale
128 000 tokens

Le raisonnement est facturé en sortie. Le mode Fast coûte le double du tarif de base.

Ouvrir la fiche et les sources →
Google

Gemini 3.8 Flash

Entrée standard
0,75 USD / 1 million de jetons
Sortie standard
3,75 USD / 1 million de jetons
Entrée en cache
0,075 USD / 1 M tokens
Entrée par lots
0,375 USD / 1 M tokens
Sortie par lots
1,875 USD / 1 M tokens
Contexte
1 048 576 jetons d'entrée
puissance maximale
65 536 jetons de sortie

Tarifs promotionnels jusqu’au 31 décembre 2026 ; à partir de 2027, les tarifs standard doublent.

Ouvrir la fiche et les sources →
Coût par tâche

Inclut les tentatives, les outils, la récupération, le cache et la révision humaine.

Limite de fonctionnement

Les limites de compte et de région peuvent différer de la capacité théorique du modèle.

Données manquantes

L'absence est retenue comme information pertinente et non comme un zéro.

02

Ce qui manque dans le prix par token

Un tarif bas peut finir par coûter cher si le flux répète le travail ou nécessite beaucoup de supervision.

01

Raisonnement et longueur

Les tokens internes ou de raisonnement sont généralement facturés en sortie et dépendent de la difficulté et de l’effort configuré.

02

Outils et grounding

La recherche, les cartes, l’exécution de code et d’autres outils peuvent entraîner des tarifs par appel en plus des tokens.

03

Cache et lots

Les préfixes répétés et le traitement asynchrone réduisent le coût, mais exigent de concevoir le flux pour en tirer parti.

04

Coût de l’erreur

Mesurez les nouvelles tentatives, la validation humaine, les incidents et la récupération : ils font partie du coût total d’exploitation.