Q
ALIBABA QWEN / qwen3-max-2026-01-23

Qwen3‑Max Thinking

Multimodales Schlussfolgern, Code und komplexe Probleme.

01 / ZUSAMMENFASSUNG

Das Wesentliche

ORIENTIERUNGLang andauerndes Schlussfolgern

Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.

KONTEXT262.000 tokens

Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.

AUSFAHRT65.000 tokens

Dokumentierte maximale Erzeugungsgrenze.

ZUGANGQwen API · Alibaba Cloud Model Studio

Verifizierte Verfügbarkeitskanäle.

MODELLTYPText und Begründung

Primäre Funktionsfamilie und verifizierte Spezialisierungen.

LIZENZProprietär

Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.

02 / TECHNISCHES DATENBLATT

Limits und Integration

API-IDqwen3-max-2026-01-23
ModelltypText und Begründung
ZugangsmodellKostenpflichtig proprietär
LizenzProprietär
EinsatzGehostete API
Veröffentlichung25. JAN 2026
WissensstichtagNicht veröffentlicht
EingangText
AusfahrtText
Kontextfenster262.000 tokens
maximale Leistung65.000 tokens
ArgumentationModi mit und ohne Reasoning
Veröffentlichte ToolsFunktionen · Websuche · Webextraktion · Code-Interpreter
Strukturierte AusflügeUnterstützt
StapelverarbeitungUnterstützt
Prompt-CacheUnterstützt
FeinabstimmungNicht veröffentlicht
Verifizierte PlattformenQwen API · Qwen Chat · Alibaba Cloud
EIGNET SICH BESSER FÜR

Multimodales Schlussfolgern, Code und komplexe Probleme.

SOLLTE BEOBACHTET WERDEN

Die Ausführungsbedingungen variieren je Benchmark; vergleichen Sie nicht nur die Zahl.

03 / FÄHIGKEITEN

Was es kann

01

Orientierung

Multimodales Schlussfolgern, Code und komplexe Probleme.

02

Kontext

262.000 tokens · 65.000 tokens

03

Tools und Integration

Funktionen · Websuche · Web-Extraktion · Code-Interpreter

04

Zugang

Qwen API · Alibaba Cloud Model Studio

Eingabemodalitäten
Text
04 / PREISE

Dokumentierte Kosten

KonzeptWertEinheit/Zustand
Standardeingabe1,20 USD / 1 M tokens (≤32k)Standardtarif der API
Eingabe aus dem Cache0,24 USD / 1 M tokensLesen wiederverwendeter Präfixe
Schreiben oder Speichern im CacheNicht veröffentlichtDie Bedingung variiert je nach Anbieter
Standardausgabe6,00 USD / 1 M tokens (≤32k)Kann Reasoning-Tokens enthalten
Batch-Eingabe0,60 USD / 1 M tokens (≤32k)Asynchrone Verarbeitung
Batch-Ausgabe3,00 USD / 1 M tokens (≤32k)Asynchrone Verarbeitung

Oberhalb von 32.000 Token gelten höhere Preisstufen.

i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.

05 / BEWERTUNGEN

So lesen Sie die Ergebnisse

“

Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.

BenchmarkErgebnisMetrikQuelle
GPQA Diamond92,8 %GenauigkeitQuelle öffnen ↗
LiveCodeBench v691,4 %GenauigkeitQuelle öffnen ↗
Humanity's Last Exam58,3 %Mit WerkzeugenQuelle öffnen ↗

Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.

06 / VERSIONEN

Chronologie

Qwen3‑Max Thinking

In den verifizierten Katalog von Inferama aufgenommene Version.

07 / QUELLEN

Rückverfolgbarkeit