Aphrodite Engine é um servidor de inferência de alto rendimento baseado em vLLM, otimizado para atender muitos usuários ao mesmo tempo com amplo suporte a quantização e amostragem.
| Categoria | Servidor de inferência |
| Tipo | Servidor de inferência |
| Licença | AGPL-3.0 |
| Executa localmente | Auto-hospedado |
| Construído com | Python |
| Nível de habilidade | Avançado |
| Melhor para | atendendo muitos usuários com alto rendimento |
Outras ferramentas de servidor de inferência de código aberto que valem a pena comparar:
vLLMServiço de alta capacidade para produção
TGIServidor de texto de produção da Hugging Face
SGLangServiço rápido com saídas estruturadas
LMDeployKit de ferramentas para comprimir e servir LLMs
TensorRT-LLMMáxima taxa de transferência em GPUs NVIDIA
OpenLLMSirva qualquer modelo aberto como uma API OpenAI em um comando
KTransformersExecute enormes modelos MoE em uma GPU de consumidor
Ray ServeEscalone a entrega de modelos em um cluster
BentoMLEmpacote qualquer modelo em uma API de produçãoO Aphrodite Engine é gratuito e de código aberto (licença AGPL-3.0), então você pode usá-lo, hospedá-lo e modificá-lo sem custo.
Sim. O Aphrodite Engine é projetado para rodar na sua própria máquina ou servidor, mantendo seus dados privados.
Alternativas populares de código aberto incluem vLLM, TGI, SGLang. Veja as comparações acima para escolher.
Navegue pelo diretório completo de ferramentas, modelos e projetos de IA de código aberto — atualizado diariamente.
Navegue por todas as ferramentas →