Kit de ferramentas de quantização (compressão) de modelo LLM com suporte a aceleração de HW para GPU Nvidia, AMD, Intel e CPU Intel/AMD/Apple via HF, vLLM e SGLang.
Comprimir grandes modelos de linguagem para rodar mais rápido em vários tipos de hardware de computador.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserKit de ferramentas de quantização (compressão) de modelo LLM com suporte a aceleração de HW para GPU Nvidia, AMD, Intel e CPU Intel/AMD/Apple via HF, vLLM e SGLang.
GPTQModel tem 1.2k estrelas no GitHub. Foi bifurcado 195 vezes. GPTQModel é escrito principalmente em Python. Está em desenvolvimento ativo desde 2024. Os seus principais temas são: gptq, optimum, peft, quantization.
Kit de ferramentas de quantização (compressão) de modelo LLM com suporte a aceleração de HW para GPU Nvidia, AMD, Intel e CPU Intel/AMD/Apple via HF, vLLM e SGLang.
GPTQModel é um projeto de código aberto.
Sim. GPTQModel é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
GPTQModel é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/modelcloud-gptqmodel.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.