GLM-5.3-FlashX est la variante à haute vitesse de GLM-5.3-Flash de Z.ai, un modèle multimodal natif offrant des vitesses d'inférence allant jusqu'à 200 jetons/s.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Artificial Analysis mesure 289 des 425 modèles suivis ici — celui-ci n'est pas encore couvert. La position tarifaire ci-dessus est mesurée sur l'ensemble du catalogue et ne dépend pas des référentiels.
GLM 5.3 FlashX est un modèle d'IA open-weight de Z.AI. Vous pouvez le télécharger et l'auto-héberger gratuitement ; les prix ci-dessous sont les tarifs d'API hébergée, suivis quotidiennement, pour ceux qui préfèrent la commodité à l'auto-hébergement.
GLM 5.3 FlashX est un modèle de langage IA de Z.AI. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger GLM 5.3 FlashX et ne rien payer par jeton. Si vous préférez une API hébergée, les tarifs sont de 0,37 $ par million de jetons d'entrée et 1,25 $ par million de jetons de sortie.
Oui. GLM 5.3 FlashX a des poids ouverts, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.