Uso primario dichiarato o dedotto con cautela dalla documentazione ufficiale.
Claude Sonnet 5
Codice, ricerca e flussi professionali con strumenti.
L'essenziale
Capacità di input massima quando pubblicata dalla fonte.
Limite massimo di generazione documentato.
Canali di disponibilità verificati.
Famiglia funzionale principale e specialità verificate.
Condizioni dichiarate per API, pesi o distribuzione autonoma.
Limiti e integrazione
| ID API | claude-sonnet-5 |
|---|---|
| Tipo di modello | Testo e ragionamento |
| Modalità di accesso | Proprietario a pagamento |
| Licenza | Proprietaria |
| Distribuzione | API ospitata |
| Rilascio | 30 GIU 2026 |
| Cutoff della conoscenza | GEN 2026 |
| Entrata | Testo · Immagine |
| Uscita | Testo |
| Finestra di contesto | 1.000.000 token |
| rendimento massimo | 128.000 token |
| Ragionamento | Ragionamento adattivo · livello di sforzo configurabile |
| Strumenti pubblicati | Utilizzo degli strumenti · Ricerca web · Esecuzione di codice · Uso del computer |
| Uscite strutturate | Supportato |
| Elaborazione batch | Compatibile · 50 % di sconto |
| Cache dei prompt | Compatibile · fino al 90 % di risparmio sulle letture |
| Fine-tuning | Non pubblicato |
| Piattaforme verificate | Claude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry |
Codice, ricerca e flussi professionali con strumenti.
Costo e prestazioni dipendono dal livello di ragionamento.
Cosa può fare
Orientamento
Codice, ricerca e flussi professionali con strumenti.
Contesto
1.000.000 token · 128.000 token
Strumenti e integrazione
Uso di strumenti · Ricerca web · Esecuzione del codice · Uso del computer
Accesso
Claude, Claude API e cloud associati
Costo documentato
| Concetto | Di valore | Unità/condizione |
|---|---|---|
| Input standard | 2,00 USD / 1 M token | Tariffa API standard |
| Input in cache | 0,20 USD / 1 M token | Lettura di prefissi riutilizzati |
| Scrittura o archiviazione della cache | 2,50–4,00 USD / 1 M token | La condizione varia in base al fornitore |
| Output standard | 10,00 USD / 1 M token | Può includere token di ragionamento |
| Input batch | 1,00 USD / 1 M token | Elaborazione asincrona |
| Output batch | 5,00 USD / 1 M token | Elaborazione asincrona |
Consulta la fonte primaria prima di preventivare una distribuzione.
i I prezzi cambiano e possono dipendere dal livello, dalla regione o dalla durata del contesto. Controlla la fonte prima di prendere una decisione.
Come leggere i risultati
Un benchmark pubblico orienta, ma non sostituisce una valutazione con i tuoi dati, strumenti, budget e tolleranza all'errore.
| Benchmark | Risultato | Metrica | Fonte |
|---|---|---|---|
| OSWorld-Verified | Curva per livello di sforzo | Successo e costo | Vedi fonte ↗ |
| BrowseComp | Curva per livello di sforzo | Accuratezza e costo | Vedi fonte ↗ |
Inferama evidenzia un "miglior risultato" solo quando la metrica, il set di test, la configurazione e la data consentono un confronto equivalente. I dati del fornitore sono presentati come affermazioni provenienti dalla propria fonte.
Cronologia
Claude Sonnet 5
Versione inclusa nel catalogo verificato di Inferama.
Analisi correlate
Claude Sonnet 5: come misurare l’impatto del nuovo tokenizer prima della migrazione
Anthropic segnala che con Sonnet 5 lo stesso testo può essere convertito in più token rispetto a Sonnet 4.6. Un protocollo basato su un corpus proprio permette di verificare se questo riduce il contesto utile o modifica il costo per attività in una specifica integrazione.
23 set 2026 ↗ ANALISISBrowseComp: che cosa misura un agente che trova un dato difficile sul web e perché un risultato corretto non prova che svolga una ricerca affidabile
BrowseComp valuta se un agente sia in grado di individuare una risposta fattuale breve e difficile da trovare attraverso una navigazione web persistente. È un segnale utile, ma circoscritto: un punteggio elevato non basta a dimostrare qualità della ricerca, tracciabilità delle fonti o affidabilità nei compiti aperti.
22 set 2026 ↗ COMPARATIVAClaude Sonnet 5 e Cohere Embed 4 nel RAG multimodale: come separare un errore di recupero da un errore di risposta
Claude Sonnet 5 e Cohere Embed 4 operano in livelli diversi di un sistema RAG multimodale. Questa guida propone un esperimento fattoriale, con corpus e condizioni congelati, per misurare separatamente se è stata recuperata l'evidenza corretta e se la risposta la ha usata fedelmente.
22 set 2026 ↗ GUIAClaude Fable 5.1: quando cache e batch riducono il costo per attività — e quando spostano soltanto la fattura
La tariffa per milione di token non basta per scegliere tra una chiamata normale, la cache delle istruzioni o l'elaborazione batch. Questa guida propone un modello di costo per attività completata correttamente per Claude Fable 5.1, con formule, scenari e telemetria minima. Il risultato dipende dal riutilizzo del contesto prima della scadenza, dal controllo dei tentativi ripetuti e dall'accettazione — o meno — della tempistica asincrona della Batch API.
22 set 2026 ↗ ANALISISAnthropic: come verificare cosa cambia usando Claude tramite API, cloud partner o prodotto
Adottare Claude non significa soltanto scegliere una famiglia di modelli. Il canale di accesso determina quale identificatore viene usato, quale calendario di ritiro si applica, quali controlli gestisce ciascuna parte e quale documentazione può sostenere una decisione tecnica. Questa guida propone un metodo per separare questi livelli senza trasformare politiche pubbliche o valutazioni di sicurezza in garanzie che non forniscono.
22 set 2026 ↗