Z
Z.AI / glm-5.3-flash

GLM‑5.3‑Flash

Variante multimodal de 320.000 millones de parámetros totales y 18.000 millones activos, enfocada en eficiencia.

01 / RESUMEN

Lo esencial

ORIENTACIÓNMultimodal abierto y eficiente

Uso principal declarado o inferido con cautela desde la documentación oficial.

CONTEXTO1.000.000 tokens

Capacidad máxima de entrada cuando la fuente la publica.

SALIDANo publicado

Límite máximo de generación documentado.

ACCESOZ.AI API · pesos abiertos

Canales de disponibilidad verificados.

TIPO DE MODELOTexto y razonamiento · Código · Visión y documentos

Familia funcional principal y especialidades verificadas.

LICENCIAConsultar licencia de pesos

Condiciones declaradas para API, pesos o despliegue propio.

02 / FICHA TÉCNICA

Límites e integración

ID de APIglm-5.3-flash
Tipo de modeloTexto y razonamiento · Código · Visión y documentos
Modelo de accesoAPI y pesos abiertos
LicenciaConsultar licencia de pesos
DespliegueAPI o despliegue propio
Lanzamiento26 AGO 2026
Corte de conocimientoNo publicado
EntradaTexto · Imagen
SalidaTexto
Ventana de contexto1.000.000 tokens
Salida máximaNo publicado
RazonamientoEsfuerzo configurable
Herramientas publicadasFunciones · Agentes de código
Salidas estructuradasNo publicado
Procesamiento por lotesNo publicado
Caché de promptsNo publicado
Ajuste finoNo publicado
Plataformas verificadasZ.AI API · Hugging Face
ENCAJA MEJOR EN

Código, visión y agentes con costes de inferencia reducidos.

CONVIENE VIGILAR

La capacidad multimodal y el coste dependen del proveedor y del despliegue.

03 / CAPACIDADES

Qué puede hacer

01

Orientación

Código, visión y agentes con costes de inferencia reducidos.

02

Contexto

1.000.000 tokens · No publicado

03

Herramientas e integración

Funciones · Agentes de código

04

Acceso

Z.AI API · pesos abiertos

Modalidades de entrada
TextoImagen
04 / PRECIOS

Coste documentado

ConceptoValorUnidad / condición
Entrada estándarNo publicadoTarifa estándar de API
Entrada en cachéNo publicadoLectura de prefijos reutilizados
Escritura o almacenamiento de cachéNo publicadoLa condición varía según proveedor
Salida estándarNo publicadoPuede incluir tokens de razonamiento
Entrada por lotesNo publicadoProcesamiento asíncrono
Salida por lotesNo publicadoProcesamiento asíncrono

Consulta la fuente primaria antes de presupuestar un despliegue.

i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.

05 / EVALUACIONES

Cómo leer los resultados

“

Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.

BenchmarkResultadoMétricaFuente
DeepSWE v1.163,4 %ExactitudVer fuente ↗

Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.

06 / VERSIONES

Cronología

GLM‑5.3‑Flash

Versión incorporada al catálogo verificado de Inferama.

07 / FUENTES

Trazabilidad