Uso primario dichiarato o dedotto con cautela dalla documentazione ufficiale.
GLM‑5.3‑Flash
Variante multimodale con 320.000 miliardi di parametri totali e 18.000 miliardi attivi, orientata all’efficienza.
L'essenziale
Capacità di input massima quando pubblicata dalla fonte.
Limite massimo di generazione documentato.
Canali di disponibilità verificati.
Famiglia funzionale principale e specialità verificate.
Condizioni dichiarate per API, pesi o distribuzione autonoma.
Limiti e integrazione
| ID API | glm-5.3-flash |
|---|---|
| Tipo di modello | Testo e ragionamento · Codice · Visione e documenti |
| Modalità di accesso | API e pesi aperti |
| Licenza | Consultare la licenza dei pesi |
| Distribuzione | API o deployment autonomo |
| Rilascio | 26 AGO 2026 |
| Cutoff della conoscenza | Non pubblicato |
| Entrata | Testo · Immagine |
| Uscita | Testo |
| Finestra di contesto | 1.000.000 token |
| rendimento massimo | Non pubblicato |
| Ragionamento | Impegno configurabile |
| Strumenti pubblicati | Funzionalità · Agenti di codice |
| Uscite strutturate | Non pubblicato |
| Elaborazione batch | Non pubblicato |
| Cache dei prompt | Non pubblicato |
| Fine-tuning | Non pubblicato |
| Piattaforme verificate | Z.AI API · Hugging Face |
Programmazione, visione e agenti con costi di inferenza ridotti.
Le capacità multimodali e il costo dipendono dal provider e dalla modalità di deployment.
Cosa può fare
Orientamento
Programmazione, visione e agenti con costi di inferenza ridotti.
Contesto
1.000.000 token · Non pubblicato
Strumenti e integrazione
Funzioni · Agenti di programmazione
Accesso
Z.AI API · pesi aperti
Costo documentato
| Concetto | Di valore | Unità/condizione |
|---|---|---|
| Input standard | Non pubblicato | Tariffa API standard |
| Input in cache | Non pubblicato | Lettura di prefissi riutilizzati |
| Scrittura o archiviazione della cache | Non pubblicato | La condizione varia in base al fornitore |
| Output standard | Non pubblicato | Può includere token di ragionamento |
| Input batch | Non pubblicato | Elaborazione asincrona |
| Output batch | Non pubblicato | Elaborazione asincrona |
Consulta la fonte primaria prima di preventivare una distribuzione.
i I prezzi cambiano e possono dipendere dal livello, dalla regione o dalla durata del contesto. Controlla la fonte prima di prendere una decisione.
Come leggere i risultati
Un benchmark pubblico orienta, ma non sostituisce una valutazione con i tuoi dati, strumenti, budget e tolleranza all'errore.
| Benchmark | Risultato | Metrica | Fonte |
|---|---|---|---|
| DeepSWE v1.1 | 63,4 % | Accuratezza | Vedi fonte ↗ |
Inferama evidenzia un "miglior risultato" solo quando la metrica, il set di test, la configurazione e la data consentono un confronto equivalente. I dati del fornitore sono presentati come affermazioni provenienti dalla propria fonte.
Cronologia
GLM‑5.3‑Flash
Versione inclusa nel catalogo verificato di Inferama.