GLM-5.3-Flash è un modello multimodale nativo di Z.ai.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per GLM 5.3 Flash, misurati da Artificial Analysis. Più alto è meglio.
GLM 5.3 Flash è un modello AI open-weight di Z.AI. Può scaricarlo e self-hostarlo gratuitamente; i prezzi di seguito sono prezzi di listino per API ospitate, aggiornati quotidianamente, per quando preferisce la comodità rispetto al self-hosting.
GLM 5.3 Flash è un modello di linguaggio AI di Z.AI. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 57.5 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — può self-hostare GLM 5.3 Flash e non pagare nulla per token. Se preferisce un'API ospitata, i prezzi di listino sono $0,08 per milione di token di input e $0,25 per milione di token di output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 91.2%, Humanity's Last Exam 39.9%, Long Context Reasoning 78%, SciCode 46.1%, τ-Bench Banking 47.2%, Terminal-Bench 84.3%. È particolarmente utilizzato per generazione di codice.
Genera circa 49.2 token al secondo, con una mediana 1.18s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. GLM 5.3 Flash ha open weights, quindi può scaricarlo ed eseguirlo sulla propria GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza alcun costo per token.