GLM-4.7 est le dernier modèle phare de Z.ai, présentant des améliorations dans deux domaines clés : des capacités de programmation améliorées et un raisonnement/exécution multi-étapes plus stable.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour GLM 4.7, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
GLM 4.7 est un modèle d'IA open-weight de Z.AI. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
GLM 4.7 est un modèle de langage IA de Z.AI. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 34.5 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger GLM 4.7 et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,4 $ par million de jetons d'entrée et de 1,75 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 85.9%, MMLU-Pro 85.6%, Humanity's Last Exam 27.4%, Long Context Reasoning 68%, LiveCodeBench 89.4%, SciCode 45.1%, AIME 2025 95%, IFBench 67.9%, τ²-Bench 95.9%, τ-Bench Banking 12.2%, Terminal-Bench 45.3%, Terminal-Bench Hard 31.8%. Il est particulièrement utilisé pour génération de code.
Oui. GLM 4.7 a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.