Z.AI · alle Modelle ›

ZGLM 5.3 FlashOPEN

GLM-5.3-Flash ist ein natives multimodales Modell von Z.ai.

1.3MKontextfenster · Tokens
$0.08Eingabepreis · pro M Tokens
$0.25Ausgabepreis · pro M Tokens
Z.AIAnbieter

Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für GLM 5.3 Flash, gemessen von Artificial Analysis. Höher ist besser.

39×
Mehr Intelligenz pro Dollar als Claude Opus 5 (Fast).
Für dasselbe Budget bietet GLM 5.3 Flash die 39-fache Leistungsfähigkeit. Open weights bedeuten auch, dass Sie es selbst hosten und nichts pro Token zahlen können.
Intelligence index57.5
Coding index71.5
GPQA91.2%
Humanity's Last Exam39.9%
Long Context Reasoning78%
SciCode46.1%
τ-Bench Banking47.2%
Terminal-Bench84.3%
⚡ Speed49.2 tokens/sec
⏱ Latency1.18s to first token
💰 Blended price$0.237 / 1M tokens
📈 Value242.6 intelligence points per $
vs. Modelle, die hier gemessen werdenoberste 4%
Scores höher als 96% der 273 Modelle, die von Artificial Analysis gemessen und hier verfolgt werden.
Modelle auf diesem Niveau kosten $3 pro 1M Tokens (Median von 14) — dieses kostet $0.12.
Kein hier verfolgtes Modell ist sowohl günstiger als auch besser in diesem Index.
Benchmark-Daten von Artificial Analysis

Über dieses Modell

GLM 5.3 Flash ist ein open-weight KI-Modell von Z.AI. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Bequemlichkeit dem Selbsthosten vorziehen.

Häufig gestellte Fragen

Was ist GLM 5.3 Flash?

GLM 5.3 Flash ist ein KI-Sprachmodell von Z.AI. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 57.5 im Artificial Analysis Intelligenzindex.

Ist GLM 5.3 Flash kostenlos?

Die Gewichte sind frei und offen — Sie können GLM 5.3 Flash selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,08 $ pro Million Eingabe-Tokens und 0,25 $ pro Million Ausgabe-Tokens.

Worin ist GLM 5.3 Flash gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 91.2%, Humanity's Last Exam 39.9%, Long Context Reasoning 78%, SciCode 46.1%, τ-Bench Banking 47.2%, Terminal-Bench 84.3%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist GLM 5.3 Flash?

Es generiert etwa 49.2 Tokens pro Sekunde, mit einer Median 1.18s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Können Sie GLM 5.3 Flash selbst hosten?

Ja. GLM 5.3 Flash hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem eigenen Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Verwandte Modelle

GLM 5.2Z.AIGLM 5.3Z.AIGLM 5.1Z.AIGLM 4.7Z.AIGLM 5Z.AIGLM 5V TurboZ.AI