Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
Qwen3‑Max Thinking
Raisonnement multimodal, code et problèmes complexes.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | qwen3-max-2026-01-23 |
|---|---|
| Type de modèle | Texte et raisonnement |
| Mode d’accès | Propriétaire payant |
| Licence | Propriétaire |
| Déploiement | API hébergée |
| Lancement | 25 JANV 2026 |
| Date limite des connaissances | Non publié |
| Entrée | Texte |
| Sortie | Texte |
| Fenêtre contextuelle | 262.000 tokens |
| puissance maximale | 65.000 tokens |
| Raisonnement | Modes avec et sans raisonnement |
| Outils publiés | Fonctions · Recherche web · Extraction web · Interpréteur de code |
| Sorties structurées | Pris en charge |
| Traitement par lots | Pris en charge |
| Cache de prompts | Pris en charge |
| Ajustement fin | Non publié |
| Plateformes vérifiées | Qwen API · Qwen Chat · Alibaba Cloud |
Raisonnement multimodal, code et problèmes complexes.
Les conditions d’exécution varient selon les benchmarks ; ne comparez pas seulement le chiffre.
Ce qu’il peut faire
Orientation
Raisonnement multimodal, code et problèmes complexes.
Contexte
262.000 tokens · 65.000 tokens
Outils et intégration
Fonctionnalités · Recherche web · Extraction web · Interpréteur de code
Accès
Qwen API · Alibaba Cloud Model Studio
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | 1,20 USD / 1 M tokens (≤32k) | Tarif API standard |
| Entrée en cache | 0,24 USD / 1 M tokens | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | Non publié | La condition varie selon le fournisseur |
| Sortie standard | 6,00 USD / 1 M tokens (≤32k) | Peut inclure des tokens de raisonnement |
| Entrée par lots | 0,60 USD / 1 M tokens (≤32k) | Traitement asynchrone |
| Sortie par lots | 3,00 USD / 1 M tokens (≤32k) | Traitement asynchrone |
Des tarifs supérieurs s’appliquent au-delà de 32 000 tokens.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| GPQA Diamond | 92,8 % | Exactitude | Voir la source ↗ |
| LiveCodeBench v6 | 91,4 % | Exactitude | Voir la source ↗ |
| Humanity's Last Exam | 58,3 % | Avec outils | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
Qwen3‑Max Thinking
Version intégrée au catalogue vérifié d’Inferama.