DECISIONE/COMPARATORE

Modelli faccia a faccia.

Una lettura comune di capacità, accesso, contesto, prezzo e data di verifica.

Scegli due o tre modelli
O
Si adatta meglio a
Ragionamento complesso, ricerca, codice, documenti e agenti con strumenti.
Da monitorare
Prezzo per token più elevato; richiede autorizzazioni minime e revisione per le azioni sensibili.
A
Anthropic

Claude Opus 5

Si adatta meglio a
Codice agentivo, refactoring estesi, conoscenza aziendale e lavoro visivo.
Da monitorare
Le risposte tendono a essere estese e il ragionamento attivo può aumentare i token di output.
Si adatta meglio a
Agenti a basso costo, software di lunga durata e analisi multimodale estesa.
Da monitorare
Il prezzo è introduttivo e l'uso del grounding può generare addebiti per query.
CriterioGPT‑6 AstraClaude Opus 5Gemini 3.8 Flash
Identità e validità
OrganizzazioneOpenAIAnthropicGoogle
ID APIgpt-6-astraclaude-opus-5gemini-3.8-flash
StatoDisponibileRisorsaGA stabile
Rilascio3 settembre 202624 luglio 20262 settembre 2026
Cutoff della conoscenza30 aprile 2026Maggio 2026Non pubblicato nella fonte consultata
ProfiloFrontiera generalistaConoscenza e codiceMultimodale veloce
Capacità e modalità
EntrataTesto · ImmagineTesto · ImmagineTesto · Immagine · Video · Audio · PDF
UscitaTestoTestoTesto
Finestra di contesto1.050.000 token1.000.000 token1.048.576 gettoni di ingresso
rendimento massimo128.000 token128.000 token65.536 token di output
RagionamentoLivello di sforzo low, medium, high, xhigh e maxRagionamento adattivo · livello di sforzo configurabileLivelli low, medium e high
Latenza relativaModerata; dipende dal livello di sforzo di ragionamentoModerata · modalità Fast disponibile nell'APIProfilo Flash orientato a velocità ed efficienza
Strumenti e integrazione
Strumenti pubblicatiFunzionalità · Ricerca web · Ricerca nei file · Interprete di codice · Shell ospitata · Uso del computer · MCPUtilizzo degli strumenti · Ricerca web · Esecuzione di codice · Uso del computerFunzionalità · Ricerca web · Google Maps · Esecuzione di codice · Uso del computer (preview) · Ricerca nei file · Contesto URL
Uscite strutturateCompatibileCompatibileCompatibile
Elaborazione batchCompatibile · 50 % di scontoCompatibile · 50 % di scontoCompatibile · 50 % di sconto
Cache dei promptCompatibileCompatibile · fino al 90 % di risparmio sulle lettureCompatibile
Fine-tuningNon compatibileNon pubblicato nella fonte consultataNon pubblicato nella fonte consultata
Prezzo API standard
Prezzo d'ingresso10,00 USD / 1 M token5,00 USD / 1 M tokenGettoni da 0,75 USD / 1 milione
Input in cache1,00 USD / 1 M token0,50 USD / 1 M token0,075 USD / 1 M token
Scrittura o archiviazione della cache12,50 USD / 1 M token6,25 USD / 1 M token (5 min) · 10,00 USD (1 h)0,50 USD / 1 M token all'ora di archiviazione
Prezzo di partenza50,00 USD / 1 M token25,00 USD / 1 M tokenGettoni da 3,75 USD / 1 milione
Input batch5,00 USD / 1 M token2,50 USD / 1 M token0,375 USD / 1 M token
Output batch25,00 USD / 1 M token12,50 USD / 1 M token1,875 USD / 1 M token
Condizioni rilevantiLe richieste con oltre 272.000 token di input applicano moltiplicatori di prezzo; gli strumenti possono aggiungere addebiti per chiamata.Il ragionamento viene fatturato come output. La modalità Fast costa il doppio della tariffa base.Prezzi introduttivi fino al 31 dicembre 2026; dal 2027 le tariffe standard raddoppiano.
Disponibilità
Canali di accessoOpenAI API · Responses, Chat Completions e BatchClaude, Claude API, AWS, Google Cloud e Microsoft FoundryGemini API · Google AI Studio · versione stabile
Piattaforme verificateOpenAI APIClaude.ai · Claude Code · Claude API · Amazon Bedrock · Google Cloud · Microsoft FoundryGemini API · Google AI Studio
Verificato
Fonte primariaScheda ufficiale di GPT‑6 Astra ↗Scheda ufficiale dei modelli Claude ↗Scheda ufficiale di Gemini 3.8 Flash ↗

i «Non pubblicato» indica che le fonti primarie consultate non forniscono quel dato. Inferama non colma le lacune mediante stime.

02

Esempio di costo comparabile

Una richiesta con 1 milione di token di input e 250.000 token di output, senza cache né strumenti.

OpenAI

GPT‑6 Astra

Standard
22,500 USD
Batch
11,250 USD
Anthropic

Claude Opus 5

Standard
11,250 USD
Batch
5,625 USD
Google

Gemini 3.8 Flash

Standard
1,688 USD
Batch
0,844 USD

i È un esempio aritmetico, non una stima del costo per attività. Il ragionamento, la cache, gli strumenti, i tentativi ripetuti e le fasce di contesto possono modificare la fattura.

03

Come prendere una decisione con questa tabella

Il modello più capace non è sempre il sistema più adatto a un flusso specifico.

01

Filtra per requisiti vincolanti

Scarta prima ciò che non supporta la tua modalità, il contesto, lo strumento, la regione o il budget massimo.

02

Prova attività proprie

Confronta qualità, latenza, tasso di errore e recupero con casi reali e una rubrica stabile.

03

Misurare l'intero sistema

Include chiamate agli strumenti, ricerche, cache, supervisione, tentativi ripetuti e costo della correzione degli errori.

04

Verifica la validità

I prezzi e i limiti cambiano. Verifica la data e apri la fonte primaria prima di sottoscrivere o migrare.

04

Fonti consultate

Documentazione tecnica, prezzi, stato e trasparenza di ciascun fornitore.