Z
Z.AI / glm-5.1

GLM‑5.1

Code, recherche et flux professionnels avec outils.

01 / RÉSUMÉ

L'essentiel

ORIENTATIONCode et agents

Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.

CONTEXTE200.000 tokens

Capacité d'entrée maximale une fois publiée par la source.

SORTIE128 000 tokens

Limite de génération maximale documentée.

ACCÈSZ.AI API · poids ouverts

Canaux de disponibilité vérifiés.

TYPE DE MODÈLETexte et raisonnement

Famille fonctionnelle principale et spécialités vérifiées.

LICENCEPropriétaire

Conditions déclarées pour l’API, les poids ou l’auto-hébergement.

02 / FICHE TECHNIQUE

Limites et intégration

ID d’APIglm-5.1
Type de modèleTexte et raisonnement
Mode d’accèsPropriétaire payant
LicencePropriétaire
DéploiementAPI hébergée
Lancement7 AVR 2026
Date limite des connaissancesNon publié
EntréeTexte
SortieTexte
Fenêtre contextuelle200.000 tokens
puissance maximale128 000 tokens
RaisonnementRaisonnement intégré
Outils publiésFonctions · Recherche web · Exécution de code
Sorties structuréesPris en charge
Traitement par lotsNon publié
Cache de promptsPris en charge
Ajustement finPoids ouverts
Plateformes vérifiéesZ.AI API · Hugging Face
CONVIENT MIEUX À

Code, recherche et flux professionnels avec outils.

À SURVEILLER

Le prix dépend du fournisseur d’inférence ou de votre propre matériel.

03 / CAPACITÉS

Ce qu’il peut faire

01

Orientation

Code, recherche et flux professionnels avec outils.

02

Contexte

200.000 tokens · 128.000 tokens

03

Outils et intégration

Fonctionnalités · Recherche web · Exécution de code

04

Accès

Z.AI API · poids ouverts

Modalités d’entrée
Texte
04 / TARIFS

Coût documenté

ConceptValeurUnité/état
Entrée standard1,40 USD / 1 M tokensTarif API standard
Entrée en cache0,26 USD / 1 M tokensLecture de préfixes réutilisés
Écriture ou stockage de cacheNon publiéLa condition varie selon le fournisseur
Sortie standard4,40 USD / 1 M tokensPeut inclure des tokens de raisonnement
Entrée par lotsNon publiéTraitement asynchrone
Sortie par lotsNon publiéTraitement asynchrone

Consultez la source primaire avant de budgétiser un déploiement.

i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.

05 / ÉVALUATIONS

Comment lire les résultats

“

Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.

BenchmarkRésultatMétriqueSource
SWE-Bench Pro58,4 %RésoluVoir la source ↗
KernelBench Level 33,6×Accélération moyenne géométriqueVoir la source ↗

Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.

06 / VERSIONS

Chronologie

GLM‑5.1

Version intégrée au catalogue vérifié d’Inferama.

07 / SOURCES

Traçabilité