Como un modelo SOTA de clase 30B, GLM-4.7-Flash ofrece una nueva opción que equilibra rendimiento y eficiencia.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para GLM 4.7 Flash, medidas por Artificial Analysis. Cuanto más alto, mejor. Modo de medición: Reasoning.
GLM 4.7 Flash es un modelo de IA open-weight de Z.AI. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el self-hosting.
GLM 4.7 Flash es un modelo de lenguaje de IA de Z.AI. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 23.3 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos — puedes autoalojar GLM 4.7 Flash y no pagar nada por token. Si prefieres una API alojada, los precios son $0.06 por millón de tokens de entrada y $0.4 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 58.1%, Humanity's Last Exam 7.6%, Long Context Reasoning 40.7%, SciCode 33.7%, IFBench 60.8%, τ²-Bench 98.8%, Terminal-Bench Hard 22%.
Sí. GLM 4.7 Flash tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.