SOTA Low-Bit LLM Quantisierung (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) & Sparsamkeit; führende Modellkompressionstechniken auf PyTorch, TensorFlow und ONNX Runtime
Wenden Sie fortgeschrittene Techniken an, um die Größe von Modellen des maschinellen Lernens für eine bessere Leistung auf gängigen Frameworks zu reduzieren.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbarSOTA Low-Bit LLM Quantisierung (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) & Sparsamkeit; führende Modellkompressionstechniken auf PyTorch, TensorFlow und ONNX Runtime
neural-compressor hat 2.7k Sterne auf GitHub. Es wurde 318-mal geforkt. neural-compressor ist hauptsächlich in Python geschrieben. Es wird seit 2020 aktiv entwickelt. neural-compressor ist unter der Apache-2.0-Lizenz verfügbar. Die Hauptthemen sind: auto-tuning, awq, fp4, gptq.
SOTA Low-Bit LLM Quantisierung (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) & Sparsamkeit; führende Modellkompressionstechniken auf PyTorch, TensorFlow und ONNX Runtime
neural-compressor ist ein Open-Source-Projekt. Es wird unter der Apache-2.0-Lizenz veröffentlicht.
Ja. neural-compressor ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
neural-compressor ist unter der Apache-2.0-Lizenz verfügbar.
neural-compressor ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://opensourceai.tech/project/intel-neural-compressor.html)