Z.AI

ZGLM 5.2OPEN

GLM 5.2 (Z.AI): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.

Kontextfenster
1M
Tokens
Eingabepreis
$0.68
pro M Tokens
Ausgabepreis
$2.15
pro M Tokens
Anbieter
Z.AI

Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für GLM 5.2, gemessen von Artificial Analysis. Höher ist besser. Messmodus: max.

3.9×
Mehr Intelligenz pro Dollar als Claude Opus 5.
Für dasselbe Budget bietet GLM 5.2 3,9-mal mehr Leistung. Open Weights bedeuten auch, dass Sie es selbst hosten können und nichts pro Token zahlen müssen.
Intelligence index51.1
Coding index68.8
GPQA89.5%
Humanity's Last Exam40.1%
Long Context Reasoning71.3%
SciCode50.5%
IFBench73.3%
τ²-Bench99.1%
τ-Bench Banking26.8%
Terminal-Bench77.9%
Terminal-Bench Hard50.8%
⚡ Speed149.6 tokens/sec
⏱ Latency0.9s to first token
💰 Blended price$2.15 / 1M tokens
📈 Value23.8 intelligence points per $
Benchmark-Daten von Artificial Analysis

Über dieses Modell

GLM 5.2 ist ein Open-Weight-AI-Modell von Z.AI. Sie können es kostenlos herunterladen und selbst hosten; die untenstehenden Preise sind Listenpreise für gehostete APIs, die stündlich verfolgt werden, wenn Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.

Häufig gestellte Fragen

Was ist GLM 5.2?

GLM 5.2 ist ein KI-Sprachmodell von Z.AI. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 51.1 im Artificial Analysis Intelligenzindex.

Ist GLM 5.2 kostenlos?

Die Gewichte sind kostenlos und offen — Sie können GLM 5.2 selbst hosten und nichts pro Token zahlen. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,68 $ pro Million Eingabetokens und 2,15 $ pro Million Ausgabetokens.

Worin ist GLM 5.2 gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 89.5%, Humanity's Last Exam 40.1%, Long Context Reasoning 71.3%, SciCode 50.5%, IFBench 73.3%, τ²-Bench 99.1%, τ-Bench Banking 26.8%, Terminal-Bench 77.9%, Terminal-Bench Hard 50.8%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist GLM 5.2?

Es generiert etwa 149.6 Tokens pro Sekunde, mit einer Median 0.9s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich GLM 5.2 selbst hosten?

Ja. GLM 5.2 hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Open-Source-Alternativen

Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.

GLM 5Z.AIGLM 5.1Z.AIGLM 4.7Z.AIGLM 4.7 FlashZ.AIGLM 4.6Z.AIGLM 5 TurboZ.AI