Aphrodite Engine es un servidor de inferencia de alto rendimiento basado en vLLM, optimizado para atender a muchos usuarios a la vez con amplio soporte de cuantización y muestreo.
| Categoría | Servidor de inferencia |
| Tipo | Servidor de inferencia |
| Licencia | AGPL-3.0 |
| Ejecuta localmente | Autoalojado |
| Construido con | Python |
| Nivel de habilidad | Avanzado |
| Mejor para | atendiendo a muchos usuarios a alto rendimiento |
Otras herramientas de servidor de inferencia de código abierto que vale la pena comparar:
vLLMServicio de alto rendimiento para producción
TGIServidor de texto de producción de Hugging Face
SGLangServicio rápido con salidas estructuradas
LMDeployConjunto de herramientas para comprimir y servir LLMs
TensorRT-LLMMáximo rendimiento en GPUs NVIDIA
OpenLLMSirve cualquier modelo abierto como una API de OpenAI en un comando
KTransformersEjecuta enormes modelos MoE en una GPU de consumo
Ray ServeEscala el servicio de modelos a través de un clúster
BentoMLEmpaqueta cualquier modelo en una API de producciónAphrodite Engine es gratuito y de código abierto (licencia AGPL-3.0), por lo que puedes usarlo, autoalojarlo y modificarlo sin costo alguno.
Sí. Aphrodite Engine está diseñado para ejecutarse en tu propia máquina o servidor, manteniendo tus datos privados.
Las alternativas populares de código abierto incluyen vLLM, TGI, SGLang. Consulta las comparaciones anteriores para elegir.
Navega por el directorio completo de herramientas, modelos y proyectos de IA de código abierto, actualizado diariamente.
Navega todas las herramientas →