vLLM

Serviço de alta capacidade para produção
Servidor de inferênciaServidor de inferênciaApache-2.0Auto-hospedadoPythonAvançado
Um número alto geralmente significa que o projeto é amplamente examinado. Um número baixo geralmente significa que ele é pouco examinado — não que seja seguro.
Nenhum sinal de atividade pública para esta ferramenta — ela não possui um repositório aberto que possamos medir.
OSAI Pulse ⓘ ★★★★★★★★★★ /100 sinais rastreados
🐳 pulls do Docker 📦 downloads do PyPI / mês 📦 downloads do npm / mês 🚀 Última versão ·
Visitar site →Ver no GitHub

O que é o vLLM?

vLLM é um motor de inferência e serviço de alta capacidade usando PagedAttention para maximizar a utilização da GPU, a escolha padrão para servir modelos abertos em grande escala.

Por que as pessoas escolhem o vLLM

vLLM em um relance

CategoriaServidor de inferência
TipoServidor de inferência
LicençaApache-2.0
Executa localmenteAuto-hospedado
Construído comPython
Nível de habilidadeAvançado
Melhor paraequipes de produção servindo modelos em grande escala

Alternativas de código aberto ao vLLM

Outras ferramentas de servidor de inferência de código aberto que valem a pena comparar:

TGIServidor de texto de produção da Hugging FaceSGLangServiço rápido com saídas estruturadasLMDeployKit de ferramentas para comprimir e servir LLMsAphrodite EngineServiço de LLM de alto desempenhoTensorRT-LLMMáxima taxa de transferência em GPUs NVIDIAOpenLLMSirva qualquer modelo aberto como uma API OpenAI em um comandoKTransformersExecute enormes modelos MoE em uma GPU de consumidorRay ServeEscalone a entrega de modelos em um clusterBentoMLEmpacote qualquer modelo em uma API de produção

vLLM confronto direto

vLLM vs TGIvLLM vs SGLangvLLM vs LMDeployvLLM vs Aphrodite EnginevLLM vs TensorRT-LLMvLLM vs OpenLLMvLLM vs KTransformersvLLM vs Ray ServevLLM vs BentoML

FAQ

O vLLM é gratuito?

O vLLM é gratuito e de código aberto (licença Apache-2.0), então você pode usar, auto-hospedar e modificar sem custo.

Posso executar o vLLM localmente?

Sim. O vLLM é projetado para rodar na sua própria máquina ou servidor, mantendo seus dados privados.

Qual é a melhor alternativa ao vLLM?

Alternativas populares de código aberto incluem TGI, SGLang, LMDeploy. Veja as comparações acima para escolher.

Explore mais IA de código aberto

Navegue pelo diretório completo de ferramentas, modelos e projetos de IA de código aberto — atualizado diariamente.

Navegue por todas as ferramentas →