Uso primario dichiarato o dedotto con cautela dalla documentazione ufficiale.
GPT‑5.6 Sol
Lavoro complesso, codice e agenti con strumenti.
L'essenziale
Capacità di input massima quando pubblicata dalla fonte.
Limite massimo di generazione documentato.
Canali di disponibilità verificati.
Famiglia funzionale principale e specialità verificate.
Condizioni dichiarate per API, pesi o distribuzione autonoma.
Limiti e integrazione
| ID API | gpt-5.6-sol |
|---|---|
| Tipo di modello | Testo e ragionamento |
| Modalità di accesso | Proprietario a pagamento |
| Licenza | Proprietaria |
| Distribuzione | API ospitata |
| Rilascio | LUG 2026 |
| Cutoff della conoscenza | 16 FEB 2026 |
| Entrata | Testo · Immagine |
| Uscita | Testo |
| Finestra di contesto | 1.050.000 token |
| rendimento massimo | 128.000 token |
| Ragionamento | Impegno none, low, medium, high, xhigh e max |
| Strumenti pubblicati | Funzionalità · Ricerca web · Ricerca nei file · Uso del computer |
| Uscite strutturate | Supportato |
| Elaborazione batch | Compatibile · 50 % di sconto |
| Cache dei prompt | Compatibile · 90 % di sconto sulle letture |
| Fine-tuning | Non pubblicato |
| Piattaforme verificate | OpenAI API |
Lavoro complesso, codice e agenti con strumenti.
Costo e prestazioni dipendono dal livello di ragionamento.
Cosa può fare
Orientamento
Lavoro complesso, codice e agenti con strumenti.
Contesto
1.050.000 token · 128.000 token
Strumenti e integrazione
Funzioni · Ricerca web · Ricerca nei file · Uso del computer
Accesso
OpenAI API · Responses e Chat Completions
Costo documentato
| Concetto | Di valore | Unità/condizione |
|---|---|---|
| Input standard | 4,00 USD / 1 M token | Tariffa API standard |
| Input in cache | 0,40 USD / 1 M token | Lettura di prefissi riutilizzati |
| Scrittura o archiviazione della cache | 5,00 USD / 1 M token | La condizione varia in base al fornitore |
| Output standard | 20,00 USD / 1 M token | Può includere token di ragionamento |
| Input batch | 2,00 USD / 1 M token | Elaborazione asincrona |
| Output batch | 10,00 USD / 1 M token | Elaborazione asincrona |
Consulta la fonte primaria prima di preventivare una distribuzione.
i I prezzi cambiano e possono dipendere dal livello, dalla regione o dalla durata del contesto. Controlla la fonte prima di prendere una decisione.
Come leggere i risultati
Un benchmark pubblico orienta, ma non sostituisce una valutazione con i tuoi dati, strumenti, budget e tolleranza all'errore.
| Benchmark | Risultato | Metrica | Fonte |
|---|---|---|---|
| Agents' Last Exam | 52,7 % | Accuratezza | Vedi fonte ↗ |
| SWE-Bench Pro | 64,6 % | Risolto | Vedi fonte ↗ |
| Terminal-Bench 2.1 | 88,8 % | Accuratezza | Vedi fonte ↗ |
Inferama evidenzia un "miglior risultato" solo quando la metrica, il set di test, la configurazione e la data consentono un confronto equivalente. I dati del fornitore sono presentati come affermazioni provenienti dalla propria fonte.
Cronologia
GPT‑5.6 Sol
Versione inclusa nel catalogo verificato di Inferama.
Analisi correlate
AutomationBench: cosa dimostra un agente che porta un flusso aziendale allo stato corretto — e cosa non dimostra
AutomationBench valuta se un agente riesce a completare flussi di lavoro tra applicazioni SaaS simulate e a portarli a uno stato finale verificabile. Questa guida spiega che cosa significa questa evidenza, come leggere le metriche e quali verifiche aggiuntive servono prima di estendere un risultato a un'azienda reale.
22 set 2026 ↗ PAPERAgents’ Last Exam: che cosa misura un agente per il lavoro reale e perché il suo tasso di successo non equivale ad «automatizzare un lavoro»
Agents’ Last Exam valuta agenti su attività professionali svolte in ambienti di sistema operativo e con risultati verificabili. Il suo progetto è utile per studiare l’esecuzione di flussi di lavoro, ma una percentuale aggregata di successo non dimostra che un’occupazione possa essere automatizzata. Per interpretarla servono dettagli sulle attività, sull’ambiente, sull’harness, sul modello, sugli strumenti, sul budget e sulla versione valutata.
22 set 2026 ↗