GLM-5.3-Flash es un modelo multimodal nativo de Z.ai.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para GLM 5.3 Flash, medidas por Artificial Analysis. Cuanto más alto, mejor.
GLM 5.3 Flash es un modelo de IA open-weight de Z.AI. Puede descargarlo y autoalojarlo gratis; los precios a continuación son precios de lista de API alojada, rastreados diariamente, para cuando prefiera la conveniencia sobre el autoalojamiento.
GLM 5.3 Flash es un modelo de lenguaje de IA de Z.AI. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 57.5 en el índice de inteligencia Artificial Analysis.
Los pesos son libres y abiertos — puede autoalojar GLM 5.3 Flash y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.08 por millón de tokens de entrada y $0.25 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 91.2%, Humanity's Last Exam 39.9%, Long Context Reasoning 78%, SciCode 46.1%, τ-Bench Banking 47.2%, Terminal-Bench 84.3%. Se utiliza particularmente para generación de código.
Genera aproximadamente 49.2 tokens por segundo, con una mediana 1.18s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. GLM 5.3 Flash tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.