Z
Z.AI / glm-5.3-flash

GLM‑5.3‑Flash

Variante multimodale con 320.000 miliardi di parametri totali e 18.000 miliardi attivi, orientata all’efficienza.

01 / RIEPILOGO

L'essenziale

ORIENTAMENTOMultimodale aperto ed efficiente

Uso primario dichiarato o dedotto con cautela dalla documentazione ufficiale.

CONTESTO1.000.000 token

Capacità di input massima quando pubblicata dalla fonte.

USCITANon pubblicato

Limite massimo di generazione documentato.

ACCESSOZ.AI API · pesi aperti

Canali di disponibilità verificati.

TIPO DI MODELLOTesto e ragionamento · Codice · Visione e documenti

Famiglia funzionale principale e specialità verificate.

LICENZAConsultare la licenza dei pesi

Condizioni dichiarate per API, pesi o distribuzione autonoma.

02 / SCHEDA TECNICA

Limiti e integrazione

ID APIglm-5.3-flash
Tipo di modelloTesto e ragionamento · Codice · Visione e documenti
Modalità di accessoAPI e pesi aperti
LicenzaConsultare la licenza dei pesi
DistribuzioneAPI o deployment autonomo
Rilascio26 AGO 2026
Cutoff della conoscenzaNon pubblicato
EntrataTesto · Immagine
UscitaTesto
Finestra di contesto1.000.000 token
rendimento massimoNon pubblicato
RagionamentoImpegno configurabile
Strumenti pubblicatiFunzionalità · Agenti di codice
Uscite strutturateNon pubblicato
Elaborazione batchNon pubblicato
Cache dei promptNon pubblicato
Fine-tuningNon pubblicato
Piattaforme verificateZ.AI API · Hugging Face
SI ADATTA MEGLIO A

Programmazione, visione e agenti con costi di inferenza ridotti.

DA MONITORARE

Le capacità multimodali e il costo dipendono dal provider e dalla modalità di deployment.

03 / CAPACITÀ

Cosa può fare

01

Orientamento

Programmazione, visione e agenti con costi di inferenza ridotti.

02

Contesto

1.000.000 token · Non pubblicato

03

Strumenti e integrazione

Funzioni · Agenti di programmazione

04

Accesso

Z.AI API · pesi aperti

Modalità di input
TestoImmagine
04 / PREZZI

Costo documentato

ConcettoDi valoreUnità/condizione
Input standardNon pubblicatoTariffa API standard
Input in cacheNon pubblicatoLettura di prefissi riutilizzati
Scrittura o archiviazione della cacheNon pubblicatoLa condizione varia in base al fornitore
Output standardNon pubblicatoPuò includere token di ragionamento
Input batchNon pubblicatoElaborazione asincrona
Output batchNon pubblicatoElaborazione asincrona

Consulta la fonte primaria prima di preventivare una distribuzione.

i I prezzi cambiano e possono dipendere dal livello, dalla regione o dalla durata del contesto. Controlla la fonte prima di prendere una decisione.

05 / VALUTAZIONI

Come leggere i risultati

“

Un benchmark pubblico orienta, ma non sostituisce una valutazione con i tuoi dati, strumenti, budget e tolleranza all'errore.

BenchmarkRisultatoMetricaFonte
DeepSWE v1.163,4 %AccuratezzaVedi fonte ↗

Inferama evidenzia un "miglior risultato" solo quando la metrica, il set di test, la configurazione e la data consentono un confronto equivalente. I dati del fornitore sono presentati come affermazioni provenienti dalla propria fonte.

06 / VERSIONI

Cronologia

GLM‑5.3‑Flash

Versione inclusa nel catalogo verificato di Inferama.

07 / FONTI

Tracciabilità