Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
Qwen3‑Max Thinking
Multimodales Schlussfolgern, Code und komplexe Probleme.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Primäre Funktionsfamilie und verifizierte Spezialisierungen.
Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.
Limits und Integration
| API-ID | qwen3-max-2026-01-23 |
|---|---|
| Modelltyp | Text und Begründung |
| Zugangsmodell | Kostenpflichtig proprietär |
| Lizenz | Proprietär |
| Einsatz | Gehostete API |
| Veröffentlichung | 25. JAN 2026 |
| Wissensstichtag | Nicht veröffentlicht |
| Eingang | Text |
| Ausfahrt | Text |
| Kontextfenster | 262.000 tokens |
| maximale Leistung | 65.000 tokens |
| Argumentation | Modi mit und ohne Reasoning |
| Veröffentlichte Tools | Funktionen · Websuche · Webextraktion · Code-Interpreter |
| Strukturierte Ausflüge | Unterstützt |
| Stapelverarbeitung | Unterstützt |
| Prompt-Cache | Unterstützt |
| Feinabstimmung | Nicht veröffentlicht |
| Verifizierte Plattformen | Qwen API · Qwen Chat · Alibaba Cloud |
Multimodales Schlussfolgern, Code und komplexe Probleme.
Die Ausführungsbedingungen variieren je Benchmark; vergleichen Sie nicht nur die Zahl.
Was es kann
Orientierung
Multimodales Schlussfolgern, Code und komplexe Probleme.
Kontext
262.000 tokens · 65.000 tokens
Tools und Integration
Funktionen · Websuche · Web-Extraktion · Code-Interpreter
Zugang
Qwen API · Alibaba Cloud Model Studio
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | 1,20 USD / 1 M tokens (≤32k) | Standardtarif der API |
| Eingabe aus dem Cache | 0,24 USD / 1 M tokens | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | Nicht veröffentlicht | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | 6,00 USD / 1 M tokens (≤32k) | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | 0,60 USD / 1 M tokens (≤32k) | Asynchrone Verarbeitung |
| Batch-Ausgabe | 3,00 USD / 1 M tokens (≤32k) | Asynchrone Verarbeitung |
Oberhalb von 32.000 Token gelten höhere Preisstufen.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.
| Benchmark | Ergebnis | Metrik | Quelle |
|---|---|---|---|
| GPQA Diamond | 92,8 % | Genauigkeit | Quelle öffnen ↗ |
| LiveCodeBench v6 | 91,4 % | Genauigkeit | Quelle öffnen ↗ |
| Humanity's Last Exam | 58,3 % | Mit Werkzeugen | Quelle öffnen ↗ |
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
Qwen3‑Max Thinking
In den verifizierten Katalog von Inferama aufgenommene Version.