COSTO/CAPACITÀ

Prezzi e limiti, con data.

Il costo pubblicato è comparabile solo quando conosciamo l'unità, la modalità e le condizioni.

01

Dati pubblicati

USD per milione di token quando la fonte utilizza tale unità.

OpenAI

GPT‑6 Astra

Input standard
10,00 USD / 1 M token
Output standard
50,00 USD / 1 M token
Input in cache
1,00 USD / 1 M token
Input batch
5,00 USD / 1 M token
Output batch
25,00 USD / 1 M token
Contesto
1.050.000 token
rendimento massimo
128.000 token

Le richieste con oltre 272.000 token di input applicano moltiplicatori di prezzo; gli strumenti possono aggiungere addebiti per chiamata.

Apri scheda e fonti →
Anthropic

Claude Opus 5

Input standard
5,00 USD / 1 M token
Output standard
25,00 USD / 1 M token
Input in cache
0,50 USD / 1 M token
Input batch
2,50 USD / 1 M token
Output batch
12,50 USD / 1 M token
Contesto
1.000.000 token
rendimento massimo
128.000 token

Il ragionamento viene fatturato come output. La modalità Fast costa il doppio della tariffa base.

Apri scheda e fonti →
Google

Gemini 3.8 Flash

Input standard
Gettoni da 0,75 USD / 1 milione
Output standard
Gettoni da 3,75 USD / 1 milione
Input in cache
0,075 USD / 1 M token
Input batch
0,375 USD / 1 M token
Output batch
1,875 USD / 1 M token
Contesto
1.048.576 gettoni di ingresso
rendimento massimo
65.536 token di output

Prezzi introduttivi fino al 31 dicembre 2026; dal 2027 le tariffe standard raddoppiano.

Apri scheda e fonti →
Costo per attività

Include nuovi tentativi, strumenti, ripristino, cache e revisione umana.

Limite operativo

I limiti di account e regioni possono differire dalla capacità teorica del modello.

Dati mancanti

L'assenza viene mantenuta come informazione rilevante, non come zero.

02

Cosa manca nel prezzo per token

Una tariffa bassa può finire per essere costosa se il flusso ripete il lavoro o richiede molta supervisione.

01

Ragionamento e lunghezza

I token interni o di ragionamento vengono generalmente fatturati come output e dipendono dalla difficoltà e dal livello di sforzo configurato.

02

Strumenti e grounding

Ricerca, mappe, esecuzione di codice e altri strumenti possono avere prezzi per chiamata oltre ai token.

03

Cache e batch

I prefissi ripetuti e l'elaborazione asincrona riducono il costo, ma richiedono di progettare il flusso per sfruttarli.

04

Costo dell'errore

Misura tentativi ripetuti, validazione umana, incidenti e recupero: fanno parte del costo totale operativo.