Accueil Projets Star-Attention
Star-Attention

Star-Attention

par NVIDIA · GitHub

Inférence LLM efficace sur de longues séquences

Voir sur GitHub
⭐ Étoiles
🍴 Forks
📜 Licence
Utilisation commerciale autorisée
📅 Créé
🔄 Dernier commit
🏷️ Catégorie
💻 Langue
Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
Star-Attention — GitHub preview card
📈 Historique des étoiles
392391
2026-07-202026-07-29
📈 Suivez Star-Attention

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Inférence LLM efficace sur de longues séquences

Star-Attention compte 391 étoiles sur GitHub. Il a été forké 24 fois. Star-Attention est écrit principalement en Python. Il est développé activement depuis 2024. Star-Attention est disponible sous licence Apache-2.0. Ses principaux thèmes sont : attention-mechanism, large-language-models, llm-inference.

Frequently asked questions

Qu'est-ce que Star-Attention ?

Inférence LLM efficace sur de longues séquences

Star-Attention est-il open source ?

Star-Attention est un projet open source. Il est distribué sous licence Apache-2.0.

Star-Attention est-il gratuit ?

Oui. Star-Attention est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est Star-Attention ?

Star-Attention est disponible sous licence Apache-2.0.

Dans quel langage Star-Attention est-il écrit ?

Star-Attention est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — Star-Attention

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=nvidia-star-attention)](https://olud.ai/project/nvidia-star-attention.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
Medusa
Medusa : Cadre Simple pour Accélérer la Génération LLM avec Plusieurs Têtes de Décodage
2.8k · llm
partagellm-inference
x-transformers
Un transformateur complet mais concis avec un ensemble de fonctionnalités expérimentales promet…
5.9k · artificial-intelligence
partageattention-mechanism
gpt4all
GPT4All : Exécutez des LLM locaux sur n'importe quel appareil. Open-source et disponible pour u…
77.4k · ai-chat
partagellm-inference
reformer-pytorch
Reformer, le Transformer efficace, en Pytorch
2.2k · artificial-intelligence
partageattention-mechanism
blast
VMs en tant que service open-source
778 · ai-agents
partagellm-inference
EAGLE
Implémentation officielle de EAGLE-1 (ICML'24), EAGLE-2 (EMNLP'24) et EAGLE-3 (NeurIPS'25).
2.5k · large-language-models
partagellm-inference
PaLM-pytorch
Implémentation de l'architecture Transformer spécifique de PaLM - Scaling Language Modeling wit…
825 · artificial-general-intelligence
partageattention-mechanism
parti-pytorch
Implémentation de Parti, le réseau de neurones text-to-image basé sur l'attention de Google, en…
537 · artificial-intelligence
partageattention-mechanism
lambda-networks
Implémentation de LambdaNetworks, une nouvelle approche de la reconnaissance d'images qui attei…
1.5k · artificial-intelligence
partageattention-mechanism
alphafold2
Pour finalement devenir une mise en œuvre / réplication non officielle de Pytorch d'Alphafold2,…
1.6k · artificial-intelligence
partageattention-mechanism

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.