Z.AI · todos os modelos ›

ZGLM 5.2OPEN

GLM 5.2 é um modelo de raciocínio de grande escala da Z.ai.

1MJanela de contexto · tokens
$1.19Preço de entrada · por M tokens
$3.74Preço de saída · por M tokens
Z.AIFornecedor

Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.

Ver comparações de modelos → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para GLM 5.2, medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: max.

3.9×
Mais inteligência por dólar do que Claude Opus 5 (Fast).
Com o mesmo orçamento, GLM 5.2 oferece 3.9 vezes mais capacidade. Open weights também significam que você pode self-hosted e não pagar nada por token.
Intelligence index52.6
Coding index68.8
GPQA89.5%
Humanity's Last Exam41.1%
Long Context Reasoning76.7%
SciCode50.5%
IFBench73.3%
τ²-Bench99.1%
τ-Bench Banking34.6%
Terminal-Bench77.9%
Terminal-Bench Hard50.8%
⚡ Speed68.8 tokens/sec
⏱ Latency1.12s to first token
💰 Blended price$2.15 / 1M tokens
📈 Value24.5 intelligence points per $
vs. modelos medidos aquitop 13%
Pontuações mais altas que 87% dos 273 modelos medidos pela Artificial Analysis e rastreados aqui.
Modelos neste nível custam $1.5 por 1M de tokens (mediana de 14) — este custa $1.83.
Mais barato e melhor neste índice: GLM 5.3 Flash · Gemini 3.7 Flash · Gemini 3.7 Flash (batch) e 2 a mais
Dados de benchmark por Artificial Analysis

Sobre este modelo

GLM 5.2 é um modelo de IA open-weight da Z.AI. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços públicos de API hospedada, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.

Perguntas frequentes

O que é o GLM 5.2?

GLM 5.2 é um modelo de linguagem de IA da Z.AI. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 52.6 no índice de inteligência Artificial Analysis.

O GLM 5.2 é gratuito?

Os pesos são gratuitos e abertos — você pode fazer self-host do GLM 5.2 e não pagar nada por token. Se preferir uma API hospedada, os preços de tabela são $1.19 por milhão de tokens de entrada e $3.74 por milhão de tokens de saída.

Para que serve o GLM 5.2?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 89.5%, Humanity's Last Exam 41.1%, Long Context Reasoning 76.7%, SciCode 50.5%, IFBench 73.3%, τ²-Bench 99.1%, τ-Bench Banking 34.6%, Terminal-Bench 77.9%, Terminal-Bench Hard 50.8%. É particularmente usado para geração de código.

Quão rápido é o GLM 5.2?

Ele gera cerca de 68.8 tokens por segundo, com uma mediana 1.12s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Posso auto-hospedar o GLM 5.2?

Sim. GLM 5.2 tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.

Modelos relacionados

GLM 5.3 FlashZ.AIGLM 5.3Z.AIGLM 5.1Z.AIGLM 4.7Z.AIGLM 5Z.AIGLM 5V TurboZ.AI