Z
Z.AI / glm-5.3-flash

GLM‑5.3‑Flash

Variante multimodale de 320.000 milliards de paramètres au total et 18.000 milliards de paramètres actifs, axée sur l’efficacité.

01 / RÉSUMÉ

L'essentiel

ORIENTATIONMultimodal ouvert et efficace

Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.

CONTEXTE1 000 000 tokens

Capacité d'entrée maximale une fois publiée par la source.

SORTIENon publié

Limite de génération maximale documentée.

ACCÈSZ.AI API · poids ouverts

Canaux de disponibilité vérifiés.

TYPE DE MODÈLETexte et raisonnement · Code · Vision et documents

Famille fonctionnelle principale et spécialités vérifiées.

LICENCEConsulter la licence des poids

Conditions déclarées pour l’API, les poids ou l’auto-hébergement.

02 / FICHE TECHNIQUE

Limites et intégration

ID d’APIglm-5.3-flash
Type de modèleTexte et raisonnement · Code · Vision et documents
Mode d’accèsAPI et poids ouverts
LicenceConsulter la licence des poids
DéploiementAPI ou déploiement autohébergé
Lancement26 AGO 2026
Date limite des connaissancesNon publié
EntréeTexte · Image
SortieTexte
Fenêtre contextuelle1 000 000 tokens
puissance maximaleNon publié
RaisonnementNiveau d’effort configurable
Outils publiésFonctions · Agents de code
Sorties structuréesNon publié
Traitement par lotsNon publié
Cache de promptsNon publié
Ajustement finNon publié
Plateformes vérifiéesZ.AI API · Hugging Face
CONVIENT MIEUX À

Programmation, vision et agents avec des coûts d’inférence réduits.

À SURVEILLER

Les capacités multimodales et le coût dépendent du fournisseur et du déploiement.

03 / CAPACITÉS

Ce qu’il peut faire

01

Orientation

Programmation, vision et agents avec des coûts d’inférence réduits.

02

Contexte

1.000.000 tokens · Non publié

03

Outils et intégration

Fonctions · Agents de programmation

04

Accès

Z.AI API · poids ouverts

Modalités d’entrée
TexteImage
04 / TARIFS

Coût documenté

ConceptValeurUnité/état
Entrée standardNon publiéTarif API standard
Entrée en cacheNon publiéLecture de préfixes réutilisés
Écriture ou stockage de cacheNon publiéLa condition varie selon le fournisseur
Sortie standardNon publiéPeut inclure des tokens de raisonnement
Entrée par lotsNon publiéTraitement asynchrone
Sortie par lotsNon publiéTraitement asynchrone

Consultez la source primaire avant de budgétiser un déploiement.

i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.

05 / ÉVALUATIONS

Comment lire les résultats

“

Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.

BenchmarkRésultatMétriqueSource
DeepSWE v1.163,4 %ExactitudeVoir la source ↗

Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.

06 / VERSIONS

Chronologie

GLM‑5.3‑Flash

Version intégrée au catalogue vérifié d’Inferama.

07 / SOURCES

Traçabilité