Python

vLLM

Hochdurchsatzbereitstellung für die Produktion
von vllm-project · Apache-2.0
90 619sterne21 495ForksPythonSprache9 vor Tagenletzte Übertragung
Inference-ServerInference-ServerApache-2.0SelbstgehostetPythonFortgeschritten

Aus der README

Installieren
uv pip install vllm
Dokumentation ↗

Auszüge aus der Projekt-README zu GitHub. Das Urheberrecht und die Lizenzen verbleiben bei den jeweiligen Autoren.

Eine hohe Anzahl bedeutet normalerweise, dass das Projekt intensiv geprüft wird. Eine niedrige Anzahl bedeutet normalerweise, dass es wenig geprüft wird — nicht, dass es sicher ist.
Keine öffentlichen Aktivitätssignale für dieses Tool — es hat kein offenes Repository, das wir messen können.
Olud Pulse ⓘ ★★★★★★★★★★ /100 verfolgte Signale
🐳 Docker-Pulls 📦 PyPI-Downloads / Monat 📦 npm-Downloads / Monat 🚀 Neueste Version ·
Website besuchen →Auf GitHub ansehen

Was ist vLLM?

vLLM ist eine Hochdurchsatz-Inferenz- und Bereitstellungsengine, die PagedAttention verwendet, um die GPU-Auslastung zu maximieren, die Standardwahl für die Bereitstellung offener Modelle in großem Maßstab.

Warum Menschen vLLM wählen

vLLM auf einen Blick

KategorieInference-Server
TypInference-Server
LizenzApache-2.0
Läuft lokalSelbstgehostet
Hergestellt mitPython
FähigkeitsstufeFortgeschritten
Am besten fürProduktionsteams, die Modelle in großem Maßstab bereitstellen
Siehe GitHub-Statistiken & Aktivitäten

Open-Source-Alternativen zu vLLM

Andere Open-Source-Inferenzserver-Tools, die einen Vergleich wert sind:

TGIHugging Face's Produktions-TextserverSGLangSchnelle Bereitstellung mit strukturierten AusgabenLMDeployToolkit zum Komprimieren und Bereitstellen von LLMsAphrodite EngineHochdurchsatz-LLM-BereitstellungTensorRT-LLMMaximale Durchsatzrate auf NVIDIA GPUsOpenLLMJedes offene Modell als OpenAI API mit einem Befehl bereitstellenKTransformersFühren Sie riesige MoE-Modelle auf einer Verbraucher-GPU ausRay ServeSkalieren Sie das Modell-Serving über einen ClusterBentoMLPacken Sie jedes Modell in eine Produktions-API

vLLM im direkten Vergleich

vLLM vs TGIvLLM vs SGLangvLLM vs LMDeployvLLM vs Aphrodite EnginevLLM vs TensorRT-LLMvLLM vs OpenLLMvLLM vs KTransformersvLLM vs Ray ServevLLM vs BentoML

Häufig gestellte Fragen

Ist vLLM kostenlos?

vLLM ist kostenlos und Open-Source (Apache-2.0-Lizenz), sodass Sie es kostenlos nutzen, selbst hosten und modifizieren können.

Kann ich vLLM lokal ausführen?

Ja. vLLM ist dafür ausgelegt, auf Ihrem eigenen Computer oder Server zu laufen und Ihre Daten privat zu halten.

Was ist die beste Alternative zu vLLM?

Beliebte Open-Source-Alternativen sind TGI, SGLang, LMDeploy. Siehe die obenstehenden Vergleiche zur Auswahl.

Entdecken Sie weitere Open-Source-AI

Durchsuchen Sie das vollständige Verzeichnis von Open-Source-AI-Tools, Modellen und Projekten – täglich aktualisiert.

Alle Tools durchsuchen →