Q
ALIBABA QWEN / qwen3-max-2026-01-23

Qwen3‑Max Thinking

Raisonnement multimodal, code et problèmes complexes.

01 / RÉSUMÉ

L'essentiel

ORIENTATIONRaisonnement prolongé

Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.

CONTEXTE262.000 tokens

Capacité d'entrée maximale une fois publiée par la source.

SORTIE65.000 tokens

Limite de génération maximale documentée.

ACCÈSQwen API · Alibaba Cloud Model Studio

Canaux de disponibilité vérifiés.

TYPE DE MODÈLETexte et raisonnement

Famille fonctionnelle principale et spécialités vérifiées.

LICENCEPropriétaire

Conditions déclarées pour l’API, les poids ou l’auto-hébergement.

02 / FICHE TECHNIQUE

Limites et intégration

ID d’APIqwen3-max-2026-01-23
Type de modèleTexte et raisonnement
Mode d’accèsPropriétaire payant
LicencePropriétaire
DéploiementAPI hébergée
Lancement25 JANV 2026
Date limite des connaissancesNon publié
EntréeTexte
SortieTexte
Fenêtre contextuelle262.000 tokens
puissance maximale65.000 tokens
RaisonnementModes avec et sans raisonnement
Outils publiésFonctions · Recherche web · Extraction web · Interpréteur de code
Sorties structuréesPris en charge
Traitement par lotsPris en charge
Cache de promptsPris en charge
Ajustement finNon publié
Plateformes vérifiéesQwen API · Qwen Chat · Alibaba Cloud
CONVIENT MIEUX À

Raisonnement multimodal, code et problèmes complexes.

À SURVEILLER

Les conditions d’exécution varient selon les benchmarks ; ne comparez pas seulement le chiffre.

03 / CAPACITÉS

Ce qu’il peut faire

01

Orientation

Raisonnement multimodal, code et problèmes complexes.

02

Contexte

262.000 tokens · 65.000 tokens

03

Outils et intégration

Fonctionnalités · Recherche web · Extraction web · Interpréteur de code

04

Accès

Qwen API · Alibaba Cloud Model Studio

Modalités d’entrée
Texte
04 / TARIFS

Coût documenté

ConceptValeurUnité/état
Entrée standard1,20 USD / 1 M tokens (≤32k)Tarif API standard
Entrée en cache0,24 USD / 1 M tokensLecture de préfixes réutilisés
Écriture ou stockage de cacheNon publiéLa condition varie selon le fournisseur
Sortie standard6,00 USD / 1 M tokens (≤32k)Peut inclure des tokens de raisonnement
Entrée par lots0,60 USD / 1 M tokens (≤32k)Traitement asynchrone
Sortie par lots3,00 USD / 1 M tokens (≤32k)Traitement asynchrone

Des tarifs supérieurs s’appliquent au-delà de 32 000 tokens.

i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.

05 / ÉVALUATIONS

Comment lire les résultats

“

Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.

BenchmarkRésultatMétriqueSource
GPQA Diamond92,8 %ExactitudeVoir la source ↗
LiveCodeBench v691,4 %ExactitudeVoir la source ↗
Humanity's Last Exam58,3 %Avec outilsVoir la source ↗

Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.

06 / VERSIONS

Chronologie

Qwen3‑Max Thinking

Version intégrée au catalogue vérifié d’Inferama.

07 / SOURCES

Traçabilité