Uso primario dichiarato o dedotto con cautela dalla documentazione ufficiale.
Qwen3‑Max Thinking
Ragionamento multimodale, codice e problemi complessi.
L'essenziale
Capacità di input massima quando pubblicata dalla fonte.
Limite massimo di generazione documentato.
Canali di disponibilità verificati.
Famiglia funzionale principale e specialità verificate.
Condizioni dichiarate per API, pesi o distribuzione autonoma.
Limiti e integrazione
| ID API | qwen3-max-2026-01-23 |
|---|---|
| Tipo di modello | Testo e ragionamento |
| Modalità di accesso | Proprietario a pagamento |
| Licenza | Proprietaria |
| Distribuzione | API ospitata |
| Rilascio | 25 GEN 2026 |
| Cutoff della conoscenza | Non pubblicato |
| Entrata | Testo |
| Uscita | Testo |
| Finestra di contesto | 262.000 token |
| rendimento massimo | 65.000 token |
| Ragionamento | Modalità con e senza ragionamento |
| Strumenti pubblicati | Funzionalità · Ricerca web · Estrazione web · Interprete di codice |
| Uscite strutturate | Supportato |
| Elaborazione batch | Supportato |
| Cache dei prompt | Supportato |
| Fine-tuning | Non pubblicato |
| Piattaforme verificate | Qwen API · Qwen Chat · Alibaba Cloud |
Ragionamento multimodale, codice e problemi complessi.
Le condizioni di esecuzione variano tra benchmark; non confrontare solo il numero.
Cosa può fare
Orientamento
Ragionamento multimodale, codice e problemi complessi.
Contesto
262.000 token · 65.000 token
Strumenti e integrazione
Funzioni · Ricerca web · Estrazione web · Interprete di codice
Accesso
Qwen API · Alibaba Cloud Model Studio
Costo documentato
| Concetto | Di valore | Unità/condizione |
|---|---|---|
| Input standard | 1,20 USD / 1 M token (≤32k) | Tariffa API standard |
| Input in cache | 0,24 USD / 1 M token | Lettura di prefissi riutilizzati |
| Scrittura o archiviazione della cache | Non pubblicato | La condizione varia in base al fornitore |
| Output standard | 6,00 USD / 1 M token (≤32k) | Può includere token di ragionamento |
| Input batch | 0,60 USD / 1 M token (≤32k) | Elaborazione asincrona |
| Output batch | 3,00 USD / 1 M token (≤32k) | Elaborazione asincrona |
Oltre 32.000 token si applicano fasce di prezzo superiori.
i I prezzi cambiano e possono dipendere dal livello, dalla regione o dalla durata del contesto. Controlla la fonte prima di prendere una decisione.
Come leggere i risultati
Un benchmark pubblico orienta, ma non sostituisce una valutazione con i tuoi dati, strumenti, budget e tolleranza all'errore.
| Benchmark | Risultato | Metrica | Fonte |
|---|---|---|---|
| GPQA Diamond | 92,8 % | Accuratezza | Vedi fonte ↗ |
| LiveCodeBench v6 | 91,4 % | Accuratezza | Vedi fonte ↗ |
| Humanity's Last Exam | 58,3 % | Con strumenti | Vedi fonte ↗ |
Inferama evidenzia un "miglior risultato" solo quando la metrica, il set di test, la configurazione e la data consentono un confronto equivalente. I dati del fornitore sono presentati come affermazioni provenienti dalla propria fonte.
Cronologia
Qwen3‑Max Thinking
Versione inclusa nel catalogo verificato di Inferama.