Z.AI · todos los modelos ›

ZGLM 5.3 FlashOPEN

GLM-5.3-Flash es un modelo multimodal nativo de Z.ai.

1.3MVentana de contexto · tokens
$0.08Precio de entrada · por M tokens
$0.25Precio de salida · por M tokens
Z.AIProveedor

Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.

Ver comparaciones de modelos → Comparar todos los precios de modelos

Puntuaciones de referencia y rendimiento

Puntuaciones de referencia independientes para GLM 5.3 Flash, medidas por Artificial Analysis. Cuanto más alto, mejor.

39×
Más inteligencia por dólar que Claude Opus 5 (Fast).
Por el mismo presupuesto, GLM 5.3 Flash ofrece 39 veces más capacidad. Los open weights también significan que puede autoalojarlo y no pagar nada por token.
Intelligence index57.5
Coding index71.5
GPQA91.2%
Humanity's Last Exam39.9%
Long Context Reasoning78%
SciCode46.1%
τ-Bench Banking47.2%
Terminal-Bench84.3%
⚡ Speed49.2 tokens/sec
⏱ Latency1.18s to first token
💰 Blended price$0.237 / 1M tokens
📈 Value242.6 intelligence points per $
vs. modelos medidos aquítop 4%
Puntuaciones más altas que el 96% de los 273 modelos medidos por Artificial Analysis y rastreados aquí.
Los modelos en este nivel cuestan $3 por 1M de tokens (mediana de 14) — este cuesta $0.12.
Ningún modelo rastreado aquí es más barato y mejor en este índice.
Datos de referencia por Artificial Analysis

Acerca de este modelo

GLM 5.3 Flash es un modelo de IA open-weight de Z.AI. Puede descargarlo y autoalojarlo gratis; los precios a continuación son precios de lista de API alojada, rastreados diariamente, para cuando prefiera la conveniencia sobre el autoalojamiento.

Preguntas frecuentes

¿Qué es GLM 5.3 Flash?

GLM 5.3 Flash es un modelo de lenguaje de IA de Z.AI. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 57.5 en el índice de inteligencia Artificial Analysis.

¿Es GLM 5.3 Flash gratuito?

Los pesos son libres y abiertos — puede autoalojar GLM 5.3 Flash y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.08 por millón de tokens de entrada y $0.25 por millón de tokens de salida.

¿En qué es bueno GLM 5.3 Flash?

Los benchmarks independientes de Artificial Analysis le dan GPQA 91.2%, Humanity's Last Exam 39.9%, Long Context Reasoning 78%, SciCode 46.1%, τ-Bench Banking 47.2%, Terminal-Bench 84.3%. Se utiliza particularmente para generación de código.

¿Qué tan rápido es GLM 5.3 Flash?

Genera aproximadamente 49.2 tokens por segundo, con una mediana 1.18s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.

¿Puedo autoalojar GLM 5.3 Flash?

Sí. GLM 5.3 Flash tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.

Modelos relacionados

GLM 5.2Z.AIGLM 5.3Z.AIGLM 5.1Z.AIGLM 4.7Z.AIGLM 5Z.AIGLM 5V TurboZ.AI