Z.AI · tous les modèles ›

ZGLM 5.3 Flash (batch)OPEN

GLM-5.3-Flash est un modèle multimodal natif de Z.ai.

1MFenêtre de contexte · tokens
$0.06Prix d'entrée · par M tokens
$0.2Prix de sortie · par M tokens
Z.AIFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de benchmark indépendants pour GLM 5.3 Flash (batch), mesurés par Artificial Analysis. Un score plus élevé est meilleur.

25×
Plus d'intelligence par dollar que Claude Opus 5.5.
For the same budget, GLM 5.3 Flash (batch) delivers 25 times more capability. Open weights also mean you can self-host it and pay nothing per token.
Intelligence index41.8
Coding index71.5
GPQA91.2%
Humanity's Last Exam39.9%
Long Context Reasoning80%
SciCode51.6%
τ-Bench Banking47.2%
Terminal-Bench84.3%
⚡ Speed46.9 tokens/sec
⏱ Latency3.16s to first token
💰 Blended price$0.237 / 1M tokens
📈 Value176.4 intelligence points per $
vs. modèles mesurés icitop 11%
Scores plus élevés que 89% des 289 modèles mesurés par Artificial Analysis et suivis ici.
Les modèles à ce niveau coûtent $4.56 par 1M de tokens (médiane de 12) — celui-ci coûte $0.1.
Aucun modèle suivi ici n'est à la fois moins cher et meilleur sur cet indice.
Données de benchmark par Artificial Analysis

À propos de ce modèle

GLM 5.3 Flash (batch) est un modèle d'IA open-weight de Z.AI. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.

Questions fréquemment posées

Qu'est-ce que GLM 5.3 Flash (batch) ?

GLM 5.3 Flash (batch) est un modèle de langage IA de Z.AI. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 41.8 sur l'indice d'intelligence d'Artificial Analysis.

Est-ce que GLM 5.3 Flash (batch) est gratuit ?

The weights are free and open — you can self-host GLM 5.3 Flash (batch) and pay nothing per token. If you prefer a hosted API, list prices are $0.06 per million input tokens and $0.2 per million output tokens.

À quoi GLM 5.3 Flash (batch) est-il bon ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 91.2%, Humanity's Last Exam 39.9%, Long Context Reasoning 80%, SciCode 51.6%, τ-Bench Banking 47.2%, Terminal-Bench 84.3%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse de GLM 5.3 Flash (batch) ?

Il génère environ 46.9 tokens par seconde, avec un délai médian 3.16s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je self-host GLM 5.3 Flash (batch) ?

Oui. GLM 5.3 Flash (batch) a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.

Modèles associés

GLM 5.3 FlashZ.AIGLM 5.3Z.AIGLM 5.2Z.AIGLM 5.3 FlashXZ.AIGLM 4.7Z.AIGLM 5Z.AI