Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
GLM‑5.3‑Flash
Multimodale Variante mit insgesamt 320.000 Milliarden Parametern und 18.000 Milliarden aktiven Parametern, auf Effizienz ausgelegt.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Primäre Funktionsfamilie und verifizierte Spezialisierungen.
Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.
Limits und Integration
| API-ID | glm-5.3-flash |
|---|---|
| Modelltyp | Text und Begründung · Code · Bild und Dokumente |
| Zugangsmodell | API und offene Gewichte |
| Lizenz | Lizenz der Gewichte einsehen |
| Einsatz | API oder selbst gehostete Bereitstellung |
| Veröffentlichung | 26 AGO 2026 |
| Wissensstichtag | Nicht veröffentlicht |
| Eingang | Text · Bild |
| Ausfahrt | Text |
| Kontextfenster | 1.000.000 Tokens |
| maximale Leistung | Nicht veröffentlicht |
| Argumentation | Konfigurierbarer Aufwand |
| Veröffentlichte Tools | Funktionen · Code-Agenten |
| Strukturierte Ausflüge | Nicht veröffentlicht |
| Stapelverarbeitung | Nicht veröffentlicht |
| Prompt-Cache | Nicht veröffentlicht |
| Feinabstimmung | Nicht veröffentlicht |
| Verifizierte Plattformen | Z.AI API · Hugging Face |
Programmierung, Bildverarbeitung und Agenten mit geringeren Inferenzkosten.
Multimodale Fähigkeiten und Kosten hängen vom Anbieter und vom Deployment ab.
Was es kann
Orientierung
Programmierung, Bildverarbeitung und Agenten mit geringeren Inferenzkosten.
Kontext
1.000.000 tokens · Nicht veröffentlicht
Tools und Integration
Funktionen · Programmieragenten
Zugang
Z.AI API · offene Gewichte
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | Nicht veröffentlicht | Standardtarif der API |
| Eingabe aus dem Cache | Nicht veröffentlicht | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | Nicht veröffentlicht | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | Nicht veröffentlicht | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
| Batch-Ausgabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
Konsultieren Sie die Primärquelle, bevor Sie eine Bereitstellung budgetieren.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.
| Benchmark | Ergebnis | Metrik | Quelle |
|---|---|---|---|
| DeepSWE v1.1 | 63,4 % | Genauigkeit | Quelle öffnen ↗ |
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
GLM‑5.3‑Flash
In den verifizierten Katalog von Inferama aufgenommene Version.