Aphrodite Engine ist ein Hochdurchsatz-Inferenzserver, der auf vLLM basiert und für die gleichzeitige Bedienung vieler Benutzer mit breiter Quantisierungs- und Sampling-Unterstützung optimiert ist.
| Kategorie | Inference-Server |
| Typ | Inference-Server |
| Lizenz | AGPL-3.0 |
| Läuft lokal | Selbstgehostet |
| Hergestellt mit | Python |
| Fähigkeitsstufe | Fortgeschritten |
| Am besten für | viele Benutzer mit hohem Durchsatz bedienen |
Andere Open-Source-Inferenzserver-Tools, die einen Vergleich wert sind:
vLLMHochdurchsatzbereitstellung für die Produktion
TGIHugging Face's Produktions-Textserver
SGLangSchnelle Bereitstellung mit strukturierten Ausgaben
LMDeployToolkit zum Komprimieren und Bereitstellen von LLMs
TensorRT-LLMMaximale Durchsatzrate auf NVIDIA GPUs
OpenLLMJedes offene Modell als OpenAI API mit einem Befehl bereitstellen
KTransformersFühren Sie riesige MoE-Modelle auf einer Verbraucher-GPU aus
Ray ServeSkalieren Sie das Modell-Serving über einen Cluster
BentoMLPacken Sie jedes Modell in eine Produktions-APIAphrodite Engine ist kostenlos und Open-Source (AGPL-3.0 Lizenz), sodass Sie es kostenlos nutzen, selbst hosten und modifizieren können.
Ja. Die Aphrodite Engine ist dafür ausgelegt, auf Ihrem eigenen Computer oder Server zu laufen und Ihre Daten privat zu halten.
Beliebte Open-Source-Alternativen sind vLLM, TGI, SGLang. Siehe die Vergleiche oben zur Auswahl.
Durchsuchen Sie das vollständige Verzeichnis von Open-Source-AI-Tools, Modellen und Projekten – täglich aktualisiert.
Alle Tools durchsuchen →