GLM 5.2 est un modèle de raisonnement à grande échelle de Z.ai.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de benchmark indépendants pour GLM 5.2, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : max.
GLM 5.2 est un modèle d'IA open-weight de Z.AI. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les tarifs d'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
GLM 5.2 est un modèle de langage IA de Z.AI. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 52.6 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez self-hosted GLM 5.2 et ne rien payer par token. Si vous préférez une API hébergée, les prix catalogue sont de 1,19 $ par million de tokens d’entrée et 3,74 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 89.5%, Humanity's Last Exam 41.1%, Long Context Reasoning 76.7%, SciCode 50.5%, IFBench 73.3%, τ²-Bench 99.1%, τ-Bench Banking 34.6%, Terminal-Bench 77.9%, Terminal-Bench Hard 50.8%. Il est particulièrement utilisé pour génération de code.
Il génère environ 68.8 tokens par seconde, avec un délai médian 1.12s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. GLM 5.2 a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.