Uso primário declarado ou inferido com cautela a partir da documentação oficial.
Qwen3‑Max Thinking
Raciocínio multimodal, código e problemas complexos.
O essencial
Capacidade máxima de entrada quando publicada pela fonte.
Limite máximo de geração documentado.
Canais de disponibilidade verificados.
Família funcional principal e especialidades verificadas.
Condições declaradas para API, pesos ou alojamento próprio.
Limites e integração
| ID de API | qwen3-max-2026-01-23 |
|---|---|
| Tipo de modelo | Texto e raciocínio |
| Modelo de acesso | Proprietário pago |
| Licença | Proprietária |
| Implantação | API alojada |
| Lançamento | 25 JAN 2026 |
| Data de corte do conhecimento | Não publicado |
| Entrada | Texto |
| Saída | Texto |
| Janela de contexto | 262.000 tokens |
| saída máxima | 65.000 tokens |
| Raciocínio | Modos com e sem raciocínio |
| Ferramentas publicadas | Funções · Pesquisa na Web · Extração web · Intérprete de código |
| Passeios Estruturados | Compatível |
| Processamento em lote | Compatível |
| Cache de prompts | Compatível |
| Ajuste fino | Não publicado |
| Plataformas verificadas | Qwen API · Qwen Chat · Alibaba Cloud |
Raciocínio multimodal, código e problemas complexos.
As condições de execução variam entre benchmarks; não compare apenas o número.
O que pode fazer
Orientação
Raciocínio multimodal, código e problemas complexos.
Contexto
262.000 tokens · 65.000 tokens
Ferramentas e integração
Funcionalidades · Pesquisa na Web · Extração Web · Intérprete de código
Acesso
Qwen API · Alibaba Cloud Model Studio
Custo documentado
| Conceito | Valor | Unidade/condição |
|---|---|---|
| Entrada padrão | 1,20 USD / 1 M tokens (≤32k) | Tarifa padrão da API |
| Entrada em cache | 0,24 USD / 1 M tokens | Leitura de prefixos reutilizados |
| Escrita ou armazenamento em cache | Não publicado | A condição varia consoante o fornecedor |
| Saída padrão | 6,00 USD / 1 M tokens (≤32k) | Pode incluir tokens de raciocínio |
| Entrada por lotes | 0,60 USD / 1 M tokens (≤32k) | Processamento assíncrono |
| Saída por lotes | 3,00 USD / 1 M tokens (≤32k) | Processamento assíncrono |
Acima de 32.000 tokens aplicam-se faixas de preço superiores.
i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.
Como ler os resultados
Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.
| Benchmark | Resultado | Métrica | Fonte |
|---|---|---|---|
| GPQA Diamond | 92,8 % | Exatidão | Ver fonte ↗ |
| LiveCodeBench v6 | 91,4 % | Exatidão | Ver fonte ↗ |
| Humanity's Last Exam | 58,3 % | Com ferramentas | Ver fonte ↗ |
O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.
Cronologia
Qwen3‑Max Thinking
Versão incorporada no catálogo verificado da Inferama.