Accueil Projets TensorRT-LLM
TensorRT-LLM

TensorRT-LLM

par NVIDIA · GitHub

TensorRT LLM fournit aux utilisateurs une API Python facile à utiliser pour définir des modèles de langage large (LLMs) et prend en charge des optimisations à la pointe de la technologie pour effectuer des inférences efficacement sur les GPU NVIDIA. TensorRT LLM contient également des composants pour créer des environnements d'exécution Python et C++

Voir sur GitHub
En termes simples

Optimisez et exécutez de grands modèles de langage sur des GPU NVIDIA avec une interface Python facile à utiliser.

⭐ Étoiles
🍴 Forks
🔥 Tendances
📜 Licence
Licence non spécifiée
📅 Créé
🔄 Dernier commit
🏷️ Catégorie
💻 Langue
Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
TensorRT-LLM — GitHub preview card
📈 Historique des étoiles
14.2k14.1k
2026-07-122026-07-29
📈 Suivez TensorRT-LLM

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

TensorRT LLM fournit aux utilisateurs une API Python facile à utiliser pour définir des modèles de langage large (LLMs) et prend en charge des optimisations à la pointe de la technologie pour effectuer des inférences efficacement sur les GPU NVIDIA. TensorRT LLM contient également des composants pour créer des environnements d'exécution Python et C++

TensorRT-LLM compte 14.2k étoiles sur GitHub. Il a été forké 2.6k fois. TensorRT-LLM est écrit principalement en Python. Il est développé activement depuis 2023. Ses principaux thèmes sont : blackwell, cuda, llm-serving, moe.

Read the full guide
Frequently asked questions

Qu'est-ce que TensorRT-LLM ?

TensorRT LLM fournit aux utilisateurs une API Python facile à utiliser pour définir des modèles de langage large (LLMs) et prend en charge des optimisations à la pointe de la technologie pour effectuer des inférences efficacement sur les GPU NVIDIA. TensorRT LLM contient également des composants pour créer des environnements d'exécution Python et C++

TensorRT-LLM est-il open source ?

TensorRT-LLM est un projet open source.

TensorRT-LLM est-il gratuit ?

Oui. TensorRT-LLM est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Dans quel langage TensorRT-LLM est-il écrit ?

TensorRT-LLM est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — TensorRT-LLM

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=nvidia-tensorrt-llm)](https://olud.ai/project/nvidia-tensorrt-llm.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.