Q
ALIBABA QWEN / qwen3-max-2026-01-23

Qwen3‑Max Thinking

Raciocínio multimodal, código e problemas complexos.

01 / RESUMO

O essencial

ORIENTAÇÃORaciocínio prolongado

Uso primário declarado ou inferido com cautela a partir da documentação oficial.

CONTEXTO262.000 tokens

Capacidade máxima de entrada quando publicada pela fonte.

SAÍDA65.000 tokens

Limite máximo de geração documentado.

ACESSOQwen API · Alibaba Cloud Model Studio

Canais de disponibilidade verificados.

TIPO DE MODELOTexto e raciocínio

Família funcional principal e especialidades verificadas.

LICENÇAProprietária

Condições declaradas para API, pesos ou alojamento próprio.

02 / FICHA TÉCNICA

Limites e integração

ID de APIqwen3-max-2026-01-23
Tipo de modeloTexto e raciocínio
Modelo de acessoProprietário pago
LicençaProprietária
ImplantaçãoAPI alojada
Lançamento25 JAN 2026
Data de corte do conhecimentoNão publicado
EntradaTexto
SaídaTexto
Janela de contexto262.000 tokens
saída máxima65.000 tokens
RaciocínioModos com e sem raciocínio
Ferramentas publicadasFunções · Pesquisa na Web · Extração web · Intérprete de código
Passeios EstruturadosCompatível
Processamento em loteCompatível
Cache de promptsCompatível
Ajuste finoNão publicado
Plataformas verificadasQwen API · Qwen Chat · Alibaba Cloud
ADEQUA-SE MELHOR A

Raciocínio multimodal, código e problemas complexos.

CONVÉM MONITORIZAR

As condições de execução variam entre benchmarks; não compare apenas o número.

03 / CAPACIDADES

O que pode fazer

01

Orientação

Raciocínio multimodal, código e problemas complexos.

02

Contexto

262.000 tokens · 65.000 tokens

03

Ferramentas e integração

Funcionalidades · Pesquisa na Web · Extração Web · Intérprete de código

04

Acesso

Qwen API · Alibaba Cloud Model Studio

Modalidades de entrada
Texto
04 / PREÇOS

Custo documentado

ConceitoValorUnidade/condição
Entrada padrão1,20 USD / 1 M tokens (≤32k)Tarifa padrão da API
Entrada em cache0,24 USD / 1 M tokensLeitura de prefixos reutilizados
Escrita ou armazenamento em cacheNão publicadoA condição varia consoante o fornecedor
Saída padrão6,00 USD / 1 M tokens (≤32k)Pode incluir tokens de raciocínio
Entrada por lotes0,60 USD / 1 M tokens (≤32k)Processamento assíncrono
Saída por lotes3,00 USD / 1 M tokens (≤32k)Processamento assíncrono

Acima de 32.000 tokens aplicam-se faixas de preço superiores.

i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.

05 / AVALIAÇÕES

Como ler os resultados

“

Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.

BenchmarkResultadoMétricaFonte
GPQA Diamond92,8 %ExatidãoVer fonte ↗
LiveCodeBench v691,4 %ExatidãoVer fonte ↗
Humanity's Last Exam58,3 %Com ferramentasVer fonte ↗

O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.

06 / VERSÕES

Cronologia

Qwen3‑Max Thinking

Versão incorporada no catálogo verificado da Inferama.

07 / FONTES

Rastreabilidade