Un moteur d'inférence et de service à haut débit et efficace en mémoire pour les LLMs
uv pip install vllm
Extraits du README du projet sur GitHub. Le droit d'auteur et les licences restent la propriété des auteurs respectifs.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentUn moteur d'inférence et de service à haut débit et efficace en mémoire pour les LLMs
vllm compte 90.5k étoiles sur GitHub. Il a été forké 21.4k fois. vllm est écrit principalement en Python. Il est développé activement depuis 2023. vllm est disponible sous licence Apache-2.0. Ses principaux thèmes sont : amd, blackwell, cuda, deepseek.
Read the full guideUn moteur d'inférence et de service à haut débit et efficace en mémoire pour les LLMs
vllm est un projet open source. Il est distribué sous licence Apache-2.0.
Oui. vllm est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
vllm est disponible sous licence Apache-2.0.
vllm est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://olud.ai/project/vllm-project-vllm.html)
Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.