Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
GLM‑5.3‑Flash
Variante multimodale de 320.000 milliards de paramètres au total et 18.000 milliards de paramètres actifs, axée sur l’efficacité.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | glm-5.3-flash |
|---|---|
| Type de modèle | Texte et raisonnement · Code · Vision et documents |
| Mode d’accès | API et poids ouverts |
| Licence | Consulter la licence des poids |
| Déploiement | API ou déploiement autohébergé |
| Lancement | 26 AGO 2026 |
| Date limite des connaissances | Non publié |
| Entrée | Texte · Image |
| Sortie | Texte |
| Fenêtre contextuelle | 1 000 000 tokens |
| puissance maximale | Non publié |
| Raisonnement | Niveau d’effort configurable |
| Outils publiés | Fonctions · Agents de code |
| Sorties structurées | Non publié |
| Traitement par lots | Non publié |
| Cache de prompts | Non publié |
| Ajustement fin | Non publié |
| Plateformes vérifiées | Z.AI API · Hugging Face |
Programmation, vision et agents avec des coûts d’inférence réduits.
Les capacités multimodales et le coût dépendent du fournisseur et du déploiement.
Ce qu’il peut faire
Orientation
Programmation, vision et agents avec des coûts d’inférence réduits.
Contexte
1.000.000 tokens · Non publié
Outils et intégration
Fonctions · Agents de programmation
Accès
Z.AI API · poids ouverts
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | Non publié | Tarif API standard |
| Entrée en cache | Non publié | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | Non publié | La condition varie selon le fournisseur |
| Sortie standard | Non publié | Peut inclure des tokens de raisonnement |
| Entrée par lots | Non publié | Traitement asynchrone |
| Sortie par lots | Non publié | Traitement asynchrone |
Consultez la source primaire avant de budgétiser un déploiement.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| DeepSWE v1.1 | 63,4 % | Exactitude | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
GLM‑5.3‑Flash
Version intégrée au catalogue vérifié d’Inferama.