GLM-5.3 est un modèle de raisonnement à grande échelle de Z.ai, conçu pour l'ingénierie logicielle complexe et les tâches d'agent à long terme.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour GLM 5.3, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : max.
GLM 5.3 est un modèle d'IA open-weight de Z.AI. Vous pouvez le télécharger et l'auto-héberger gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité à l'auto-hébergement.
GLM 5.3 est un modèle de langage IA de Z.AI. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 59.5 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont libres et ouverts — vous pouvez auto-héberger GLM 5.3 et ne rien payer par jeton. Si vous préférez une API hébergée, les prix indiqués sont de 1,4 $ par million de jetons en entrée et 4,4 $ par million de jetons en sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 91.7%, Humanity's Last Exam 42.3%, Long Context Reasoning 76.3%, SciCode 56.5%, τ-Bench Banking 50.3%, Terminal-Bench 83.9%. Il est particulièrement utilisé pour génération de code.
Il génère environ 65.9 tokens par seconde, avec un délai médian 1.54s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. GLM 5.3 a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.