Z.AI · tutti i modelli ›

ZGLM 5.3 FlashOPEN

GLM-5.3-Flash è un modello multimodale nativo di Z.ai.

1.3MFinestra di contesto · token
$0.08Prezzo di input · per M token
$0.25Prezzo di output · per M token
Z.AIFornitore

I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi di benchmark indipendenti per GLM 5.3 Flash, misurati da Artificial Analysis. Più alto è meglio.

39×
Maggiore intelligenza per dollaro rispetto a Claude Opus 5 (Fast).
Per lo stesso budget, GLM 5.3 Flash offre 39 volte più capacità. Open weights significano anche che può self-hostarlo e non pagare nulla per token.
Intelligence index57.5
Coding index71.5
GPQA91.2%
Humanity's Last Exam39.9%
Long Context Reasoning78%
SciCode46.1%
τ-Bench Banking47.2%
Terminal-Bench84.3%
⚡ Speed49.2 tokens/sec
⏱ Latency1.18s to first token
💰 Blended price$0.237 / 1M tokens
📈 Value242.6 intelligence points per $
vs. modelli misurati quitop 4%
Punteggi superiori a 96% dei 273 modelli misurati da Artificial Analysis e tracciati qui.
I modelli a questo livello costano $3 per 1M token (mediana di 14) — questo costa $0.12.
Nessun modello tracciato qui è sia più economico che migliore su questo indice.
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

GLM 5.3 Flash è un modello AI open-weight di Z.AI. Può scaricarlo e self-hostarlo gratuitamente; i prezzi di seguito sono prezzi di listino per API ospitate, aggiornati quotidianamente, per quando preferisce la comodità rispetto al self-hosting.

Domande frequenti

Cos'è GLM 5.3 Flash?

GLM 5.3 Flash è un modello di linguaggio AI di Z.AI. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 57.5 sull'indice di intelligenza Artificial Analysis.

GLM 5.3 Flash è gratuito?

I pesi sono gratuiti e aperti — può self-hostare GLM 5.3 Flash e non pagare nulla per token. Se preferisce un'API ospitata, i prezzi di listino sono $0,08 per milione di token di input e $0,25 per milione di token di output.

In cosa è bravo GLM 5.3 Flash?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 91.2%, Humanity's Last Exam 39.9%, Long Context Reasoning 78%, SciCode 46.1%, τ-Bench Banking 47.2%, Terminal-Bench 84.3%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce GLM 5.3 Flash?

Genera circa 49.2 token al secondo, con una mediana 1.18s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Posso self-hostare GLM 5.3 Flash?

Sì. GLM 5.3 Flash ha open weights, quindi può scaricarlo ed eseguirlo sulla propria GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza alcun costo per token.

Modelli correlati

GLM 5.2Z.AIGLM 5.3Z.AIGLM 5.1Z.AIGLM 4.7Z.AIGLM 5Z.AIGLM 5V TurboZ.AI