Startseite Projekte TensorRT-LLM
TensorRT-LLM

TensorRT-LLM

von NVIDIA · GitHub

TensorRT LLM bietet Benutzern eine benutzerfreundliche Python-API zum Definieren von großen Sprachmodellen (LLMs) und unterstützt modernste Optimierungen, um Inferenz effizient auf NVIDIA-GPUs durchzuführen. TensorRT LLM enthält auch Komponenten zur Erstellung von Python- und C++-Laufzeiten.

Auf GitHub ansehen
In einfachen Worten

Optimiere und führe große Sprachmodelle auf NVIDIA-GPUs mit einer benutzerfreundlichen Python-Schnittstelle aus.

⭐ Sterne
🍴 Forks
🔥 Trendend
📜 Lizenz
Lizenz nicht angegeben
📅 Erstellt
🔄 Letzter Commit
🏷️ Kategorie
💻 Sprache
Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
TensorRT-LLM — GitHub preview card
📈 Sternhistorie
14.2k14.1k
2026-07-122026-07-29
📈 TensorRT-LLM verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

TensorRT LLM bietet Benutzern eine benutzerfreundliche Python-API zum Definieren von großen Sprachmodellen (LLMs) und unterstützt modernste Optimierungen, um Inferenz effizient auf NVIDIA-GPUs durchzuführen. TensorRT LLM enthält auch Komponenten zur Erstellung von Python- und C++-Laufzeiten.

TensorRT-LLM hat 14.2k Sterne auf GitHub. Es wurde 2.6k-mal geforkt. TensorRT-LLM ist hauptsächlich in Python geschrieben. Es wird seit 2023 aktiv entwickelt. Die Hauptthemen sind: blackwell, cuda, llm-serving, moe.

Read the full guide
Frequently asked questions

Was ist TensorRT-LLM?

TensorRT LLM bietet Benutzern eine benutzerfreundliche Python-API zum Definieren von großen Sprachmodellen (LLMs) und unterstützt modernste Optimierungen, um Inferenz effizient auf NVIDIA-GPUs durchzuführen. TensorRT LLM enthält auch Komponenten zur Erstellung von Python- und C++-Laufzeiten.

Ist TensorRT-LLM Open Source?

TensorRT-LLM ist ein Open-Source-Projekt.

Ist TensorRT-LLM kostenlos?

Ja. TensorRT-LLM ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

In welcher Sprache ist TensorRT-LLM geschrieben?

TensorRT-LLM ist hauptsächlich in Python geschrieben.

🏅 Wartender dieses Projekts?
OpenSourceAI badge — TensorRT-LLM

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=nvidia-tensorrt-llm)](https://opensourceai.tech/project/nvidia-tensorrt-llm.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.