Z.AI · tous les modèles ›

ZGLM 5.3 FlashOPEN

GLM-5.3-Flash est un modèle multimodal natif de Z.ai.

1.3MFenêtre de contexte · tokens
$0.08Prix d'entrée · par M tokens
$0.25Prix de sortie · par M tokens
Z.AIFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour GLM 5.3 Flash, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.

39×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, GLM 5.3 Flash offre 39 fois plus de capacités. Des poids ouverts signifient également que vous pouvez l'auto-héberger et ne rien payer par jeton.
Intelligence index57.5
Coding index71.5
GPQA91.2%
Humanity's Last Exam39.9%
Long Context Reasoning78%
SciCode46.1%
τ-Bench Banking47.2%
Terminal-Bench84.3%
⚡ Speed49.2 tokens/sec
⏱ Latency1.18s to first token
💰 Blended price$0.237 / 1M tokens
📈 Value242.6 intelligence points per $
vs. modèles mesurés icitop 4%
Scores plus élevés que 96% des 273 modèles mesurés par Artificial Analysis et suivis ici.
Les modèles à ce niveau coûtent $3 par 1M de tokens (médiane de 14) — celui-ci coûte $0.12.
Aucun modèle suivi ici n'est à la fois moins cher et meilleur sur cet indice.
Données de benchmark par Artificial Analysis

À propos de ce modèle

GLM 5.3 Flash est un modèle d'IA à poids ouverts de Z.AI. Vous pouvez le télécharger et l'auto-héberger gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité à l'auto-hébergement.

Questions fréquemment posées

Qu'est-ce que GLM 5.3 Flash ?

GLM 5.3 Flash est un modèle de langage IA de Z.AI. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 57.5 sur l'indice d'intelligence d'Artificial Analysis.

GLM 5.3 Flash est-il gratuit ?

Les poids sont gratuits et ouverts — vous pouvez auto-héberger GLM 5.3 Flash et ne rien payer par jeton. Si vous préférez une API hébergée, les prix catalogue sont de $0.08 par million de jetons d'entrée et $0.25 par million de jetons de sortie.

À quoi GLM 5.3 Flash est-il bon ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 91.2%, Humanity's Last Exam 39.9%, Long Context Reasoning 78%, SciCode 46.1%, τ-Bench Banking 47.2%, Terminal-Bench 84.3%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse de GLM 5.3 Flash ?

Il génère environ 49.2 tokens par seconde, avec un délai médian 1.18s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger GLM 5.3 Flash ?

Oui. GLM 5.3 Flash a des poids ouverts, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.

Modèles associés

GLM 5.2Z.AIGLM 5.3Z.AIGLM 5.1Z.AIGLM 4.7Z.AIGLM 5Z.AIGLM 5V TurboZ.AI