vLLM

Servicio de alto rendimiento para producción
Servidor de inferenciaServidor de inferenciaApache-2.0AutoalojadoPythonAvanzado
Un alto conteo generalmente significa que el proyecto es examinado a fondo. Un bajo conteo generalmente significa que se examina poco — no que sea seguro.
No hay señales de actividad pública para esta herramienta — no tiene un repositorio abierto que podamos medir.
OSAI Pulse ⓘ ★★★★★★★★★★ /100 señales rastreadas
🐳 descargas de Docker 📦 descargas de PyPI / mes 📦 descargas de npm / mes 🚀 Última versión ·
Visitar sitio web →Ver en GitHub

¿Qué es vLLM?

vLLM es un motor de inferencia y servicio de alto rendimiento que utiliza PagedAttention para maximizar la utilización de GPU, la opción predeterminada para servir modelos abiertos a gran escala.

Por qué la gente elige vLLM

vLLM en un vistazo

CategoríaServidor de inferencia
TipoServidor de inferencia
LicenciaApache-2.0
Ejecuta localmenteAutoalojado
Construido conPython
Nivel de habilidadAvanzado
Mejor paraequipos de producción sirviendo modelos a gran escala

Alternativas de código abierto a vLLM

Otras herramientas de servidor de inferencia de código abierto que vale la pena comparar:

TGIServidor de texto de producción de Hugging FaceSGLangServicio rápido con salidas estructuradasLMDeployConjunto de herramientas para comprimir y servir LLMsAphrodite EngineServicio de LLM de alto rendimientoTensorRT-LLMMáximo rendimiento en GPUs NVIDIAOpenLLMSirve cualquier modelo abierto como una API de OpenAI en un comandoKTransformersEjecuta enormes modelos MoE en una GPU de consumoRay ServeEscala el servicio de modelos a través de un clústerBentoMLEmpaqueta cualquier modelo en una API de producción

vLLM cara a cara

vLLM vs TGIvLLM vs SGLangvLLM vs LMDeployvLLM vs Aphrodite EnginevLLM vs TensorRT-LLMvLLM vs OpenLLMvLLM vs KTransformersvLLM vs Ray ServevLLM vs BentoML

Preguntas frecuentes

¿Es vLLM gratuito?

vLLM es gratuito y de código abierto (licencia Apache-2.0), por lo que puedes usarlo, alojarlo tú mismo y modificarlo sin costo alguno.

¿Puedo ejecutar vLLM localmente?

Sí. vLLM está diseñado para ejecutarse en tu propia máquina o servidor, manteniendo tus datos privados.

¿Cuál es la mejor alternativa a vLLM?

Las alternativas de código abierto populares incluyen TGI, SGLang, LMDeploy. Consulta las comparaciones anteriores para elegir.

Explora más IA de código abierto

Navega por el directorio completo de herramientas, modelos y proyectos de IA de código abierto, actualizado diariamente.

Navega todas las herramientas →