GLM 4.7 Flash (Z.AI): tarification API en direct, fenêtre de contexte et les meilleures alternatives open-source, suivies quotidiennement par olud.ai.
Les prix se mettent à jour automatiquement — vérifiés toutes les heures par rapport aux prix de la liste des fournisseurs.
Scores de référence indépendants pour GLM 4.7 Flash, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
GLM 4.7 Flash est un modèle d'IA à poids ouverts de Z.AI. Vous pouvez le télécharger et l'héberger vous-même gratuitement ; les prix ci-dessous sont des prix de liste d'API hébergées, suivis à l'heure, pour les moments où vous préférez la commodité à l'auto-hébergement.
GLM 4.7 Flash est un modèle de langage IA de Z.AI. Il est à poids ouverts : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 22.9 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger GLM 4.7 Flash et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,06 $ par million de jetons d'entrée et de 0,4 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 58.1%, Humanity's Last Exam 7.1%, Long Context Reasoning 35%, SciCode 33.7%, IFBench 60.8%, τ²-Bench 98.8%, Terminal-Bench Hard 22%.
Oui. GLM 4.7 Flash a des poids ouverts, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.