Startseite Projekte Star-Attention
Star-Attention
Python

Star-Attention

Effiziente LLM-Inferenz über lange Sequenzen

von NVIDIA · GitHub
Sterne
Forks
Erstellt
Letzter Commit
Sprache
attention-mechanismlarge-language-modelsllm-inferenceApache-2.0Python
Auf GitHub ansehen
In einfachen Worten

Führen Sie lange Sequenz-KI-Modelle effizienter mit Star Attention aus, wodurch sich ihre Reaktionszeiten erheblich verkürzen.

Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
Star-Attention — GitHub preview card
📈 Sternhistorie
392391
2026-07-202026-08-31
📈 Star-Attention verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

Effiziente LLM-Inferenz über lange Sequenzen

Star-Attention hat 392 Sterne auf GitHub. Es wurde 24-mal geforkt. Star-Attention ist hauptsächlich in Python geschrieben. Es wird seit 2024 aktiv entwickelt. Star-Attention ist unter der Apache-2.0-Lizenz verfügbar. Die Hauptthemen sind: attention-mechanism, large-language-models, llm-inference.

Frequently asked questions

Was ist Star-Attention?

Effiziente LLM-Inferenz über lange Sequenzen

Ist Star-Attention Open Source?

Star-Attention ist ein Open-Source-Projekt. Es wird unter der Apache-2.0-Lizenz veröffentlicht.

Ist Star-Attention kostenlos?

Ja. Star-Attention ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

Unter welcher Lizenz steht Star-Attention?

Star-Attention ist unter der Apache-2.0-Lizenz verfügbar.

In welcher Sprache ist Star-Attention geschrieben?

Star-Attention ist hauptsächlich in Python geschrieben.

🏅 Wartender dieses Projekts?
olud.ai badge — Star-Attention

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![olud.ai](https://olud.ai/badge.php?tool=nvidia-star-attention)](https://olud.ai/project/nvidia-star-attention.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →
Medusa
Medusa: Einfaches Framework zur Beschleunigung der LLM-Generierung mit mehreren Decoding-Head.
2.8k · llm
teiltllm-inference
MultiModalMamba
Eine neuartige Implementierung, die ViT mit Mamba zu einem schnellen, agilen und leistungsstark…
473 · ai
teiltattention-mechanism
sign-language-translator
Python-Bibliothek & Framework zum Erstellen benutzerdefinierter Übersetzer für Hörgeschädigte u…
359 · artificial-intelligence
teiltattention-mechanism
gpt4all
GPT4All: Führen Sie lokale LLMs auf jedem Gerät aus. Open-Source und für kommerzielle Nutzung v…
77.4k · ai-chat
teiltllm-inference
reformer-pytorch
Reformer, der effiziente Transformer, in Pytorch
2.2k · artificial-intelligence
teiltattention-mechanism
x-transformers
Ein prägnanter, aber vollständiger Full-Attention-Transformer mit einer Reihe vielversprechende…
5.9k · artificial-intelligence
teiltattention-mechanism
flamingo-pytorch
Implementierung von 🦩 Flamingo, dem hochmodernen Few-Shot Visual Question Answering Attention-N…
1.3k · artificial-intelligence
teiltattention-mechanism
TimeSformer-pytorch
Implementierung von TimeSformer von Facebook AI, einer rein auf Aufmerksamkeit basierenden Lösu…
729 · artificial-intelligence
teiltattention-mechanism
nndl
邱锡鹏《神经网络与深度学习》(蒲公英书)理论书 v2 与通识版
19k · attention-mechanism
teiltattention-mechanism
GeoTransformer
[CVPR2022] Geometrischer Transformer für schnelle und robuste Punktwolkenregistrierung
966 · attention-mechanism
teiltattention-mechanism

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.