Uso principal declarado o inferido con cautela desde la documentación oficial.
Qwen3‑Max Thinking
Razonamiento multimodal, código y problemas complejos.
Lo esencial
Capacidad máxima de entrada cuando la fuente la publica.
Límite máximo de generación documentado.
Canales de disponibilidad verificados.
Familia funcional principal y especialidades verificadas.
Condiciones declaradas para API, pesos o despliegue propio.
Límites e integración
| ID de API | qwen3-max-2026-01-23 |
|---|---|
| Tipo de modelo | Texto y razonamiento |
| Modelo de acceso | Propietario de pago |
| Licencia | Propietaria |
| Despliegue | API alojada |
| Lanzamiento | 25 ENE 2026 |
| Corte de conocimiento | No publicado |
| Entrada | Texto |
| Salida | Texto |
| Ventana de contexto | 262.000 tokens |
| Salida máxima | 65.000 tokens |
| Razonamiento | Modos con y sin razonamiento |
| Herramientas publicadas | Funciones · Búsqueda web · Extracción web · Intérprete de código |
| Salidas estructuradas | Compatible |
| Procesamiento por lotes | Compatible |
| Caché de prompts | Compatible |
| Ajuste fino | No publicado |
| Plataformas verificadas | Qwen API · Qwen Chat · Alibaba Cloud |
Razonamiento multimodal, código y problemas complejos.
Las condiciones de ejecución cambian entre benchmarks; no compares solo la cifra.
Qué puede hacer
Orientación
Razonamiento multimodal, código y problemas complejos.
Contexto
262.000 tokens · 65.000 tokens
Herramientas e integración
Funciones · Búsqueda web · Extracción web · Intérprete de código
Acceso
Qwen API · Alibaba Cloud Model Studio
Coste documentado
| Concepto | Valor | Unidad / condición |
|---|---|---|
| Entrada estándar | 1,20 USD / 1 M tokens (≤32k) | Tarifa estándar de API |
| Entrada en caché | 0,24 USD / 1 M tokens | Lectura de prefijos reutilizados |
| Escritura o almacenamiento de caché | No publicado | La condición varía según proveedor |
| Salida estándar | 6,00 USD / 1 M tokens (≤32k) | Puede incluir tokens de razonamiento |
| Entrada por lotes | 0,60 USD / 1 M tokens (≤32k) | Procesamiento asíncrono |
| Salida por lotes | 3,00 USD / 1 M tokens (≤32k) | Procesamiento asíncrono |
Por encima de 32.000 tokens se aplican tramos superiores.
i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.
Cómo leer los resultados
Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.
| Benchmark | Resultado | Métrica | Fuente |
|---|---|---|---|
| GPQA Diamond | 92,8 % | Exactitud | Ver fuente ↗ |
| LiveCodeBench v6 | 91,4 % | Exactitud | Ver fuente ↗ |
| Humanity's Last Exam | 58,3 % | Con herramientas | Ver fuente ↗ |
Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.
Cronología
Qwen3‑Max Thinking
Versión incorporada al catálogo verificado de Inferama.