Accueil Projets Star-Attention
Star-Attention
Python

Star-Attention

Inférence LLM efficace sur de longues séquences

par NVIDIA · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Langue
attention-mechanismlarge-language-modelsllm-inferenceApache-2.0Python
Voir sur GitHub
En termes simples

Exécutez des modèles IA de séquence longue plus efficacement avec Star Attention, accélérant considérablement leurs temps de réponse.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
Star-Attention — GitHub preview card
📈 Historique des étoiles
392391
2026-07-202026-08-31
📈 Suivez Star-Attention

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Inférence LLM efficace sur de longues séquences

Star-Attention compte 392 étoiles sur GitHub. Il a été forké 24 fois. Star-Attention est écrit principalement en Python. Il est développé activement depuis 2024. Star-Attention est disponible sous licence Apache-2.0. Ses principaux thèmes sont : attention-mechanism, large-language-models, llm-inference.

Frequently asked questions

Qu'est-ce que Star-Attention ?

Inférence LLM efficace sur de longues séquences

Star-Attention est-il open source ?

Star-Attention est un projet open source. Il est distribué sous licence Apache-2.0.

Star-Attention est-il gratuit ?

Oui. Star-Attention est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est Star-Attention ?

Star-Attention est disponible sous licence Apache-2.0.

Dans quel langage Star-Attention est-il écrit ?

Star-Attention est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — Star-Attention

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=nvidia-star-attention)](https://olud.ai/project/nvidia-star-attention.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
Medusa
Medusa : Cadre Simple pour Accélérer la Génération LLM avec Plusieurs Têtes de Décodage
2.8k · llm
partagellm-inference
MultiModalMamba
Une nouvelle implémentation fusionnant ViT avec Mamba en un modèle multimodal rapide, agile et…
473 · ai
partageattention-mechanism
sign-language-translator
Bibliothèque et cadre Python pour construire des traducteurs personnalisés pour les malentendan…
359 · artificial-intelligence
partageattention-mechanism
gpt4all
GPT4All : Exécutez des LLM locaux sur n'importe quel appareil. Open-source et disponible pour u…
77.4k · ai-chat
partagellm-inference
reformer-pytorch
Reformer, le Transformer efficace, en Pytorch
2.2k · artificial-intelligence
partageattention-mechanism
x-transformers
Un transformateur complet mais concis avec un ensemble de fonctionnalités expérimentales promet…
5.9k · artificial-intelligence
partageattention-mechanism
flamingo-pytorch
Implémentation de 🦩 Flamingo, un réseau d'attention de question-réponse visuelle à quelques exe…
1.3k · artificial-intelligence
partageattention-mechanism
TimeSformer-pytorch
Implémentation de TimeSformer de Facebook AI, une solution purement basée sur l'attention pour…
729 · artificial-intelligence
partageattention-mechanism
nndl
邱锡鹏《神经网络与深度学习》(蒲公英书)理论书 v2 与通识版
19k · attention-mechanism
partageattention-mechanism
GeoTransformer
[CVPR2022] Transformateur Géométrique pour l'Enregistrement Rapide et Robuste de Nuages de Poin…
966 · attention-mechanism
partageattention-mechanism

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.