Aphrodite Engine est un serveur d'inférence à haut débit basé sur vLLM, optimisé pour servir de nombreux utilisateurs simultanément avec un large support de quantification et d'échantillonnage.
| Catégorie | Serveur d'inférence |
| Type | Serveur d'inférence |
| Licence | AGPL-3.0 |
| S'exécute localement | Auto-hébergé |
| Construit avec | Python |
| Niveau de compétence | Avancé |
| Meilleur pour | servir de nombreux utilisateurs à haut débit |
Autres outils de serveur d'inférence open-source à comparer :
vLLMService à haut débit pour la production
TGIServeur de texte en production de Hugging Face
SGLangService rapide avec des sorties structurées
LMDeployBoîte à outils pour compresser et servir les LLMs
TensorRT-LLMDébit maximal sur les GPU NVIDIA
OpenLLMServez n'importe quel modèle ouvert comme une API OpenAI en une commande
KTransformersExécutez d'énormes modèles MoE sur un GPU grand public
Ray ServeÉvoluez le service de modèles à travers un cluster
BentoMLEmballer n'importe quel modèle dans une API de productionL'Aphrodite Engine est gratuit et open-source (licence AGPL-3.0), vous pouvez donc l'utiliser, l'héberger vous-même et le modifier sans frais.
Oui. L'Aphrodite Engine est conçu pour fonctionner sur votre propre machine ou serveur, gardant vos données privées.
Les alternatives open-source populaires incluent vLLM, TGI, SGLang. Consultez les comparaisons ci-dessus pour choisir.
Parcourez le répertoire complet des outils, modèles et projets d'IA open-source — mis à jour quotidiennement.
Parcourez tous les outils →