GLM 4.6V (Z.AI): tarification API en direct, fenêtre de contexte et les meilleures alternatives open-source, suivies quotidiennement par OpenSourceAI.tech.
Les prix se mettent à jour automatiquement — vérifiés toutes les heures par rapport aux prix de la liste des fournisseurs.
Scores de référence indépendants pour GLM 4.6V, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
GLM 4.6V est un modèle d'IA à poids ouvert de Z.AI. Vous pouvez le télécharger et l'héberger vous-même gratuitement ; les prix ci-dessous sont les prix de liste des API hébergées, suivis à l'heure, pour lorsque vous préférez la commodité à l'auto-hébergement.
GLM 4.6V est un modèle de langage IA de Z.AI. Il est à poids ouverts : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 16.8 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger GLM 4.6V et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,3 $ par million de jetons d'entrée et de 0,9 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 71.9%, MMLU-Pro 79.9%, Humanity's Last Exam 8.9%, Long Context Reasoning 40.3%, LiveCodeBench 16%, SciCode 30.4%, AIME 2025 85.3%, IFBench 30.1%, τ²-Bench 31.6%, Terminal-Bench Hard 14.4%. Il est particulièrement utilisé pour raisonnement mathématique.
Oui. GLM 4.6V a des poids ouverts, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.
Selon votre charge de travail, un modèle à poids ouverts que vous pouvez auto-héberger peut réduire considérablement les coûts ou supprimer complètement la tarification par token. Nos pages de comparaison mettent ce modèle côte à côte avec les meilleurs concurrents open-source.