Z
Z.AI / glm-5.3-flash

GLM‑5.3‑Flash

Multimodale Variante mit insgesamt 320.000 Milliarden Parametern und 18.000 Milliarden aktiven Parametern, auf Effizienz ausgelegt.

01 / ZUSAMMENFASSUNG

Das Wesentliche

ORIENTIERUNGOffen und effizient multimodal

Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.

KONTEXT1.000.000 Tokens

Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.

AUSFAHRTNicht veröffentlicht

Dokumentierte maximale Erzeugungsgrenze.

ZUGANGZ.AI API · offene Gewichte

Verifizierte Verfügbarkeitskanäle.

MODELLTYPText und Begründung · Code · Bild und Dokumente

Primäre Funktionsfamilie und verifizierte Spezialisierungen.

LIZENZLizenz der Gewichte einsehen

Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.

02 / TECHNISCHES DATENBLATT

Limits und Integration

API-IDglm-5.3-flash
ModelltypText und Begründung · Code · Bild und Dokumente
ZugangsmodellAPI und offene Gewichte
LizenzLizenz der Gewichte einsehen
EinsatzAPI oder selbst gehostete Bereitstellung
Veröffentlichung26 AGO 2026
WissensstichtagNicht veröffentlicht
EingangText · Bild
AusfahrtText
Kontextfenster1.000.000 Tokens
maximale LeistungNicht veröffentlicht
ArgumentationKonfigurierbarer Aufwand
Veröffentlichte ToolsFunktionen · Code-Agenten
Strukturierte AusflügeNicht veröffentlicht
StapelverarbeitungNicht veröffentlicht
Prompt-CacheNicht veröffentlicht
FeinabstimmungNicht veröffentlicht
Verifizierte PlattformenZ.AI API · Hugging Face
EIGNET SICH BESSER FÜR

Programmierung, Bildverarbeitung und Agenten mit geringeren Inferenzkosten.

SOLLTE BEOBACHTET WERDEN

Multimodale Fähigkeiten und Kosten hängen vom Anbieter und vom Deployment ab.

03 / FÄHIGKEITEN

Was es kann

01

Orientierung

Programmierung, Bildverarbeitung und Agenten mit geringeren Inferenzkosten.

02

Kontext

1.000.000 tokens · Nicht veröffentlicht

03

Tools und Integration

Funktionen · Programmieragenten

04

Zugang

Z.AI API · offene Gewichte

Eingabemodalitäten
TextBild
04 / PREISE

Dokumentierte Kosten

KonzeptWertEinheit/Zustand
StandardeingabeNicht veröffentlichtStandardtarif der API
Eingabe aus dem CacheNicht veröffentlichtLesen wiederverwendeter Präfixe
Schreiben oder Speichern im CacheNicht veröffentlichtDie Bedingung variiert je nach Anbieter
StandardausgabeNicht veröffentlichtKann Reasoning-Tokens enthalten
Batch-EingabeNicht veröffentlichtAsynchrone Verarbeitung
Batch-AusgabeNicht veröffentlichtAsynchrone Verarbeitung

Konsultieren Sie die Primärquelle, bevor Sie eine Bereitstellung budgetieren.

i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.

05 / BEWERTUNGEN

So lesen Sie die Ergebnisse

“

Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.

BenchmarkErgebnisMetrikQuelle
DeepSWE v1.163,4 %GenauigkeitQuelle öffnen ↗

Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.

06 / VERSIONEN

Chronologie

GLM‑5.3‑Flash

In den verifizierten Katalog von Inferama aufgenommene Version.

07 / QUELLEN

Rückverfolgbarkeit