Z
Z.AI / glm-5.3-flash

GLM‑5.3‑Flash

Variante multimodal com 320.000 mil milhões de parâmetros no total e 18.000 mil milhões ativos, focada na eficiência.

01 / RESUMO

O essencial

ORIENTAÇÃOMultimodal aberto e eficiente

Uso primário declarado ou inferido com cautela a partir da documentação oficial.

CONTEXTO1.000.000 tokens

Capacidade máxima de entrada quando publicada pela fonte.

SAÍDANão publicado

Limite máximo de geração documentado.

ACESSOZ.AI API · pesos abertos

Canais de disponibilidade verificados.

TIPO DE MODELOTexto e raciocínio · Código · Visão e documentos

Família funcional principal e especialidades verificadas.

LICENÇAConsultar a licença dos pesos

Condições declaradas para API, pesos ou alojamento próprio.

02 / FICHA TÉCNICA

Limites e integração

ID de APIglm-5.3-flash
Tipo de modeloTexto e raciocínio · Código · Visão e documentos
Modelo de acessoAPI e pesos abertos
LicençaConsultar a licença dos pesos
ImplantaçãoAPI ou implementação própria
Lançamento26 AGO 2026
Data de corte do conhecimentoNão publicado
EntradaTexto · Imagem
SaídaTexto
Janela de contexto1.000.000 tokens
saída máximaNão publicado
RaciocínioEsforço configurável
Ferramentas publicadasFunções · Agentes de código
Passeios EstruturadosNão publicado
Processamento em loteNão publicado
Cache de promptsNão publicado
Ajuste finoNão publicado
Plataformas verificadasZ.AI API · Hugging Face
ADEQUA-SE MELHOR A

Programação, visão e agentes com custos de inferência reduzidos.

CONVÉM MONITORIZAR

As capacidades multimodais e o custo dependem do fornecedor e da implementação.

03 / CAPACIDADES

O que pode fazer

01

Orientação

Programação, visão e agentes com custos de inferência reduzidos.

02

Contexto

1.000.000 tokens · Não publicado

03

Ferramentas e integração

Funções · Agentes de programação

04

Acesso

Z.AI API · pesos abertos

Modalidades de entrada
TextoImagem
04 / PREÇOS

Custo documentado

ConceitoValorUnidade/condição
Entrada padrãoNão publicadoTarifa padrão da API
Entrada em cacheNão publicadoLeitura de prefixos reutilizados
Escrita ou armazenamento em cacheNão publicadoA condição varia consoante o fornecedor
Saída padrãoNão publicadoPode incluir tokens de raciocínio
Entrada por lotesNão publicadoProcessamento assíncrono
Saída por lotesNão publicadoProcessamento assíncrono

Consulte a fonte primária antes de orçamentar uma implementação.

i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.

05 / AVALIAÇÕES

Como ler os resultados

“

Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.

BenchmarkResultadoMétricaFonte
DeepSWE v1.163,4 %ExatidãoVer fonte ↗

O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.

06 / VERSÕES

Cronologia

GLM‑5.3‑Flash

Versão incorporada no catálogo verificado da Inferama.

07 / FONTES

Rastreabilidade