Home Progetti Star-Attention
Star-Attention

Star-Attention

di NVIDIA · GitHub

Inferenza LLM efficiente su lunghe sequenze

Visualizza su GitHub
⭐ Stelle
🍴 Fork
📜 Licenza
Uso commerciale consentito
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
Star-Attention — GitHub preview card
📈 Storia delle stelle
392391
2026-07-202026-07-29
📈 Segui Star-Attention

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Inferenza LLM efficiente su lunghe sequenze

Star-Attention ha 391 stelle su GitHub. È stato forkato 24 volte. Star-Attention è scritto principalmente in Python. È in sviluppo attivo dal 2024. Star-Attention è disponibile con licenza Apache-2.0. I suoi temi principali sono: attention-mechanism, large-language-models, llm-inference.

Frequently asked questions

Che cos'è Star-Attention?

Inferenza LLM efficiente su lunghe sequenze

Star-Attention è open source?

Star-Attention è un progetto open source. È rilasciato con licenza Apache-2.0.

Star-Attention è gratuito?

Sì. Star-Attention è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è Star-Attention?

Star-Attention è disponibile con licenza Apache-2.0.

In quale linguaggio è scritto Star-Attention?

Star-Attention è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
OpenSourceAI badge — Star-Attention

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=nvidia-star-attention)](https://opensourceai.tech/project/nvidia-star-attention.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
Medusa
Medusa: Framework Semplice per Accelerare la Generazione LLM con Teste di Decodifica Multiple
2.8k · llm
condividellm-inference
x-transformers
Un trasformatore completo ma conciso con un insieme di promettenti funzionalità sperimentali da…
5.9k · artificial-intelligence
condivideattention-mechanism
gpt4all
GPT4All: Esegui LLM locali su qualsiasi dispositivo. Open-source e disponibile per uso commerci…
77.4k · ai-chat
condividellm-inference
reformer-pytorch
Reformer, il Transformer efficiente, in Pytorch
2.2k · artificial-intelligence
condivideattention-mechanism
blast
VM open-source come servizio
778 · ai-agents
condividellm-inference
EAGLE
Implementazione ufficiale di EAGLE-1 (ICML'24), EAGLE-2 (EMNLP'24) e EAGLE-3 (NeurIPS'25).
2.5k · large-language-models
condividellm-inference
PaLM-pytorch
Implementazione dell'architettura Transformer specifica da PaLM - Scaling Language Modeling wit…
825 · artificial-general-intelligence
condivideattention-mechanism
parti-pytorch
Implementazione di Parti, la rete neurale text-to-image basata su pura attenzione di Google, in…
537 · artificial-intelligence
condivideattention-mechanism
lambda-networks
Implementazione di LambdaNetworks, un nuovo approccio al riconoscimento delle immagini che ragg…
1.5k · artificial-intelligence
condivideattention-mechanism
alphafold2
Per diventare eventualmente un'implementazione / replicazione non ufficiale di Pytorch di Alpha…
1.6k · artificial-intelligence
condivideattention-mechanism

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.