Als ein 30B-Klasse SOTA-Modell bietet GLM-4.7-Flash eine neue Option, die Leistung und Effizienz ausbalanciert.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für GLM 4.7 Flash, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.
GLM 4.7 Flash ist ein Open-Weight-KI-Modell von Z.AI. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind die Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Komfort dem Selbsthosten vorziehen.
GLM 4.7 Flash ist ein KI-Sprachmodell von Z.AI. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 23.3 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können GLM 4.7 Flash selbst hosten und nichts pro Token bezahlen. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,06 $ pro Million Eingabetokens und 0,4 $ pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 58.1%, Humanity's Last Exam 7.6%, Long Context Reasoning 40.7%, SciCode 33.7%, IFBench 60.8%, τ²-Bench 98.8%, Terminal-Bench Hard 22%.
Ja. GLM 4.7 Flash hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.