Home Progetti Star-Attention
Star-Attention
Python

Star-Attention

Inferenza LLM efficiente su lunghe sequenze

di NVIDIA · GitHub
Stelle
Fork
Licenza
Creato
Ultimo commit
Lingua
attention-mechanismlarge-language-modelsllm-inferenceApache-2.0Python
Visualizza su GitHub
In parole semplici

Esegui modelli AI a lungo termine in modo più efficiente con Star Attention, accelerando significativamente i loro tempi di risposta.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
Star-Attention — GitHub preview card
📈 Storia delle stelle
392391
2026-07-202026-08-31
📈 Segui Star-Attention

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Inferenza LLM efficiente su lunghe sequenze

Star-Attention ha 392 stelle su GitHub. È stato forkato 24 volte. Star-Attention è scritto principalmente in Python. È in sviluppo attivo dal 2024. Star-Attention è disponibile con licenza Apache-2.0. I suoi temi principali sono: attention-mechanism, large-language-models, llm-inference.

Frequently asked questions

Che cos'è Star-Attention?

Inferenza LLM efficiente su lunghe sequenze

Star-Attention è open source?

Star-Attention è un progetto open source. È rilasciato con licenza Apache-2.0.

Star-Attention è gratuito?

Sì. Star-Attention è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è Star-Attention?

Star-Attention è disponibile con licenza Apache-2.0.

In quale linguaggio è scritto Star-Attention?

Star-Attention è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — Star-Attention

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvidia-star-attention)](https://olud.ai/project/nvidia-star-attention.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
Medusa
Medusa: Framework Semplice per Accelerare la Generazione LLM con Teste di Decodifica Multiple
2.8k · llm
condividellm-inference
MultiModalMamba
Un'implementazione innovativa che fonde ViT con Mamba in un modello Multi-Modale veloce, agile…
473 · ai
condivideattention-mechanism
sign-language-translator
Libreria e framework Python per costruire traduttori personalizzati per non udenti e tradurre t…
359 · artificial-intelligence
condivideattention-mechanism
gpt4all
GPT4All: Esegui LLM locali su qualsiasi dispositivo. Open-source e disponibile per uso commerci…
77.4k · ai-chat
condividellm-inference
reformer-pytorch
Reformer, il Transformer efficiente, in Pytorch
2.2k · artificial-intelligence
condivideattention-mechanism
x-transformers
Un trasformatore completo ma conciso con un insieme di promettenti funzionalità sperimentali da…
5.9k · artificial-intelligence
condivideattention-mechanism
flamingo-pytorch
Implementazione di 🦩 Flamingo, rete di attenzione all'avanguardia per domande visive a pochi co…
1.3k · artificial-intelligence
condivideattention-mechanism
TimeSformer-pytorch
Implementazione di TimeSformer di Facebook AI, una soluzione puramente basata su attenzione per…
729 · artificial-intelligence
condivideattention-mechanism
nndl
邱锡鹏《神经网络与深度学习》(蒲公英书)理论书 v2 与通识版
19k · attention-mechanism
condivideattention-mechanism
GeoTransformer
[CVPR2022] Trasformatore Geometrico per Registrazione Rapida e Robusta di Point Cloud
966 · attention-mechanism
condivideattention-mechanism

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.