Cuantización de LLM de bajo bit SOTA (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) y escasez; técnicas de compresión de modelos líderes en PyTorch, TensorFlow y ONNX Runtime
Aplica técnicas avanzadas para reducir el tamaño de los modelos de aprendizaje automático para un mejor rendimiento en marcos populares.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasCuantización de LLM de bajo bit SOTA (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) y escasez; técnicas de compresión de modelos líderes en PyTorch, TensorFlow y ONNX Runtime
neural-compressor tiene 2.7k estrellas en GitHub. Se ha bifurcado 318 veces. neural-compressor está escrito principalmente en Python. Se desarrolla activamente desde 2020. neural-compressor está disponible bajo la licencia Apache-2.0. Sus temas principales son: auto-tuning, awq, fp4, gptq.
Cuantización de LLM de bajo bit SOTA (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) y escasez; técnicas de compresión de modelos líderes en PyTorch, TensorFlow y ONNX Runtime
neural-compressor es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. neural-compressor es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
neural-compressor está disponible bajo la licencia Apache-2.0.
neural-compressor está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/intel-neural-compressor.html)