Z.AI · todos los modelos ›

ZGLM 5.3 Flash (batch)OPEN

GLM-5.3-Flash es un modelo multimodal nativo de Z.ai.

1MVentana de contexto · tokens
$0.06Precio de entrada · por M tokens
$0.2Precio de salida · por M tokens
Z.AIProveedor

Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.

Ver comparaciones de modelos → Comparar todos los precios de modelos

Puntuaciones de referencia y rendimiento

Independent benchmark scores for GLM 5.3 Flash (batch), measured by Artificial Analysis. Higher is better.

25×
Más inteligencia por dólar que Claude Opus 5.5.
For the same budget, GLM 5.3 Flash (batch) delivers 25 times more capability. Open weights also mean you can self-host it and pay nothing per token.
Intelligence index41.8
Coding index71.5
GPQA91.2%
Humanity's Last Exam39.9%
Long Context Reasoning80%
SciCode51.6%
τ-Bench Banking47.2%
Terminal-Bench84.3%
⚡ Speed51 tokens/sec
⏱ Latency3.25s to first token
💰 Blended price$0.237 / 1M tokens
📈 Value176.4 intelligence points per $
vs. modelos medidos aquítop 11%
Puntuaciones más altas que el 89% de los 289 modelos medidos por Artificial Analysis y rastreados aquí.
Los modelos en este nivel cuestan $4.5 por 1M de tokens (mediana de 12) — este cuesta $0.1.
Ningún modelo rastreado aquí es más barato y mejor en este índice.
Datos de referencia por Artificial Analysis

Acerca de este modelo

GLM 5.3 Flash (batch) is an open-weight AI model by Z.AI. You can download and self-host it for free; the prices below are hosted-API list prices, tracked daily, for when you prefer convenience over self-hosting.

Preguntas frecuentes

What is GLM 5.3 Flash (batch)?

GLM 5.3 Flash (batch) es un modelo de lenguaje de IA de Z.AI. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 41.8 en el índice de inteligencia Artificial Analysis.

Is GLM 5.3 Flash (batch) free?

The weights are free and open — you can self-host GLM 5.3 Flash (batch) and pay nothing per token. If you prefer a hosted API, list prices are $0.06 per million input tokens and $0.2 per million output tokens.

What is GLM 5.3 Flash (batch) good at?

Los benchmarks independientes de Artificial Analysis le dan GPQA 91.2%, Humanity's Last Exam 39.9%, Long Context Reasoning 80%, SciCode 51.6%, τ-Bench Banking 47.2%, Terminal-Bench 84.3%. Se utiliza particularmente para generación de código.

How fast is GLM 5.3 Flash (batch)?

Genera aproximadamente 51 tokens por segundo, con una mediana 3.25s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.

Can I self-host GLM 5.3 Flash (batch)?

Yes. GLM 5.3 Flash (batch) has open weights, so you can download it and run it on your own GPU or server with tools like Ollama, vLLM or llama.cpp — with no per-token cost.

Modelos relacionados

GLM 5.3 FlashZ.AIGLM 5.3Z.AIGLM 5.2Z.AIGLM 5.3 FlashXZ.AIGLM 4.7Z.AIGLM 5Z.AI