Come modello SOTA di classe 30B, GLM-4.7-Flash offre una nuova opzione che bilancia prestazioni ed efficienza.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per GLM 4.7 Flash, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.
GLM 4.7 Flash è un modello AI open-weight di Z.AI. Puoi scaricarlo e self-hostarlo gratuitamente; i prezzi sottostanti sono i prezzi di listino delle API hosted, monitorati quotidianamente, per quando preferisci la comodità al self-hosting.
GLM 4.7 Flash è un modello di linguaggio AI di Z.AI. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 23.3 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi ospitare GLM 4.7 Flash da solo e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di listino sono $0.06 per milione di token in input e $0.4 per milione di token in output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 58.1%, Humanity's Last Exam 7.6%, Long Context Reasoning 40.7%, SciCode 33.7%, IFBench 60.8%, τ²-Bench 98.8%, Terminal-Bench Hard 22%.
Sì. GLM 4.7 Flash ha open weights, quindi può scaricarlo ed eseguirlo sulla sua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.