GLM 5.2 é um modelo de raciocínio de grande escala da Z.ai.
Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.
Pontuações de benchmark independentes para GLM 5.2, medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: max.
GLM 5.2 é um modelo de IA open-weight da Z.AI. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços públicos de API hospedada, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.
GLM 5.2 é um modelo de linguagem de IA da Z.AI. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 52.6 no índice de inteligência Artificial Analysis.
Os pesos são gratuitos e abertos — você pode fazer self-host do GLM 5.2 e não pagar nada por token. Se preferir uma API hospedada, os preços de tabela são $1.19 por milhão de tokens de entrada e $3.74 por milhão de tokens de saída.
Benchmarks independentes da Artificial Analysis dão a ele GPQA 89.5%, Humanity's Last Exam 41.1%, Long Context Reasoning 76.7%, SciCode 50.5%, IFBench 73.3%, τ²-Bench 99.1%, τ-Bench Banking 34.6%, Terminal-Bench 77.9%, Terminal-Bench Hard 50.8%. É particularmente usado para geração de código.
Ele gera cerca de 68.8 tokens por segundo, com uma mediana 1.12s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.
Sim. GLM 5.2 tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.