Q
ALIBABA QWEN / qwen3-max-2026-01-23

Qwen3‑Max Thinking

Razonamiento multimodal, código y problemas complejos.

01 / RESUMEN

Lo esencial

ORIENTACIÓNRazonamiento prolongado

Uso principal declarado o inferido con cautela desde la documentación oficial.

CONTEXTO262.000 tokens

Capacidad máxima de entrada cuando la fuente la publica.

SALIDA65.000 tokens

Límite máximo de generación documentado.

ACCESOQwen API · Alibaba Cloud Model Studio

Canales de disponibilidad verificados.

TIPO DE MODELOTexto y razonamiento

Familia funcional principal y especialidades verificadas.

LICENCIAPropietaria

Condiciones declaradas para API, pesos o despliegue propio.

02 / FICHA TÉCNICA

Límites e integración

ID de APIqwen3-max-2026-01-23
Tipo de modeloTexto y razonamiento
Modelo de accesoPropietario de pago
LicenciaPropietaria
DespliegueAPI alojada
Lanzamiento25 ENE 2026
Corte de conocimientoNo publicado
EntradaTexto
SalidaTexto
Ventana de contexto262.000 tokens
Salida máxima65.000 tokens
RazonamientoModos con y sin razonamiento
Herramientas publicadasFunciones · Búsqueda web · Extracción web · Intérprete de código
Salidas estructuradasCompatible
Procesamiento por lotesCompatible
Caché de promptsCompatible
Ajuste finoNo publicado
Plataformas verificadasQwen API · Qwen Chat · Alibaba Cloud
ENCAJA MEJOR EN

Razonamiento multimodal, código y problemas complejos.

CONVIENE VIGILAR

Las condiciones de ejecución cambian entre benchmarks; no compares solo la cifra.

03 / CAPACIDADES

Qué puede hacer

01

Orientación

Razonamiento multimodal, código y problemas complejos.

02

Contexto

262.000 tokens · 65.000 tokens

03

Herramientas e integración

Funciones · Búsqueda web · Extracción web · Intérprete de código

04

Acceso

Qwen API · Alibaba Cloud Model Studio

Modalidades de entrada
Texto
04 / PRECIOS

Coste documentado

ConceptoValorUnidad / condición
Entrada estándar1,20 USD / 1 M tokens (≤32k)Tarifa estándar de API
Entrada en caché0,24 USD / 1 M tokensLectura de prefijos reutilizados
Escritura o almacenamiento de cachéNo publicadoLa condición varía según proveedor
Salida estándar6,00 USD / 1 M tokens (≤32k)Puede incluir tokens de razonamiento
Entrada por lotes0,60 USD / 1 M tokens (≤32k)Procesamiento asíncrono
Salida por lotes3,00 USD / 1 M tokens (≤32k)Procesamiento asíncrono

Por encima de 32.000 tokens se aplican tramos superiores.

i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.

05 / EVALUACIONES

Cómo leer los resultados

“

Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.

BenchmarkResultadoMétricaFuente
GPQA Diamond92,8 %ExactitudVer fuente ↗
LiveCodeBench v691,4 %ExactitudVer fuente ↗
Humanity's Last Exam58,3 %Con herramientasVer fuente ↗

Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.

06 / VERSIONES

Cronología

Qwen3‑Max Thinking

Versión incorporada al catálogo verificado de Inferama.

07 / FUENTES

Trazabilidad