GLM-5.3-Flash ist ein natives multimodales Modell von Z.ai.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für GLM 5.3 Flash (batch), gemessen von Artificial Analysis. Höher ist besser.
GLM 5.3 Flash (batch) ist ein Open-Weight-KI-Modell von Z.AI. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Bequemlichkeit gegenüber Self-Hosting bevorzugen.
GLM 5.3 Flash (batch) ist ein KI-Sprachmodell von Z.AI. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 41.8 im Artificial Analysis Intelligenzindex.
The weights are free and open — you can self-host GLM 5.3 Flash (batch) and pay nothing per token. If you prefer a hosted API, list prices are $0.06 per million input tokens and $0.2 per million output tokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 91.2%, Humanity's Last Exam 39.9%, Long Context Reasoning 80%, SciCode 51.6%, τ-Bench Banking 47.2%, Terminal-Bench 84.3%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 46.9 Tokens pro Sekunde, mit einer Median 3.16s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Yes. GLM 5.3 Flash (batch) has open weights, so you can download it and run it on your own GPU or server with tools like Ollama, vLLM or llama.cpp — with no per-token cost.