Q
ALIBABA QWEN / qwen3-max-2026-01-23

Qwen3‑Max Thinking

Ragionamento multimodale, codice e problemi complessi.

01 / RIEPILOGO

L'essenziale

ORIENTAMENTORagionamento prolungato

Uso primario dichiarato o dedotto con cautela dalla documentazione ufficiale.

CONTESTO262.000 token

Capacità di input massima quando pubblicata dalla fonte.

USCITA65.000 token

Limite massimo di generazione documentato.

ACCESSOQwen API · Alibaba Cloud Model Studio

Canali di disponibilità verificati.

TIPO DI MODELLOTesto e ragionamento

Famiglia funzionale principale e specialità verificate.

LICENZAProprietaria

Condizioni dichiarate per API, pesi o distribuzione autonoma.

02 / SCHEDA TECNICA

Limiti e integrazione

ID APIqwen3-max-2026-01-23
Tipo di modelloTesto e ragionamento
Modalità di accessoProprietario a pagamento
LicenzaProprietaria
DistribuzioneAPI ospitata
Rilascio25 GEN 2026
Cutoff della conoscenzaNon pubblicato
EntrataTesto
UscitaTesto
Finestra di contesto262.000 token
rendimento massimo65.000 token
RagionamentoModalità con e senza ragionamento
Strumenti pubblicatiFunzionalità · Ricerca web · Estrazione web · Interprete di codice
Uscite strutturateSupportato
Elaborazione batchSupportato
Cache dei promptSupportato
Fine-tuningNon pubblicato
Piattaforme verificateQwen API · Qwen Chat · Alibaba Cloud
SI ADATTA MEGLIO A

Ragionamento multimodale, codice e problemi complessi.

DA MONITORARE

Le condizioni di esecuzione variano tra benchmark; non confrontare solo il numero.

03 / CAPACITÀ

Cosa può fare

01

Orientamento

Ragionamento multimodale, codice e problemi complessi.

02

Contesto

262.000 token · 65.000 token

03

Strumenti e integrazione

Funzioni · Ricerca web · Estrazione web · Interprete di codice

04

Accesso

Qwen API · Alibaba Cloud Model Studio

Modalità di input
Testo
04 / PREZZI

Costo documentato

ConcettoDi valoreUnità/condizione
Input standard1,20 USD / 1 M token (≤32k)Tariffa API standard
Input in cache0,24 USD / 1 M tokenLettura di prefissi riutilizzati
Scrittura o archiviazione della cacheNon pubblicatoLa condizione varia in base al fornitore
Output standard6,00 USD / 1 M token (≤32k)Può includere token di ragionamento
Input batch0,60 USD / 1 M token (≤32k)Elaborazione asincrona
Output batch3,00 USD / 1 M token (≤32k)Elaborazione asincrona

Oltre 32.000 token si applicano fasce di prezzo superiori.

i I prezzi cambiano e possono dipendere dal livello, dalla regione o dalla durata del contesto. Controlla la fonte prima di prendere una decisione.

05 / VALUTAZIONI

Come leggere i risultati

“

Un benchmark pubblico orienta, ma non sostituisce una valutazione con i tuoi dati, strumenti, budget e tolleranza all'errore.

BenchmarkRisultatoMetricaFonte
GPQA Diamond92,8 %AccuratezzaVedi fonte ↗
LiveCodeBench v691,4 %AccuratezzaVedi fonte ↗
Humanity's Last Exam58,3 %Con strumentiVedi fonte ↗

Inferama evidenzia un "miglior risultato" solo quando la metrica, il set di test, la configurazione e la data consentono un confronto equivalente. I dati del fornitore sono presentati come affermazioni provenienti dalla propria fonte.

06 / VERSIONI

Cronologia

Qwen3‑Max Thinking

Versione inclusa nel catalogo verificato di Inferama.

07 / FONTI

Tracciabilità