Início Projetos Star-Attention
Star-Attention

Star-Attention

por NVIDIA · GitHub

Inferência LLM Eficiente sobre Longas Sequências

Ver no GitHub
⭐ Estrelas
🍴 Forks
📜 Licença
Uso comercial permitido
📅 Criado
🔄 Último commit
🏷️ Categoria
💻 Linguagem
Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
Star-Attention — GitHub preview card
📈 Histórico de estrelas
392391
2026-07-202026-07-29
📈 Acompanhe Star-Attention

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

Inferência LLM Eficiente sobre Longas Sequências

Star-Attention tem 391 estrelas no GitHub. Foi bifurcado 24 vezes. Star-Attention é escrito principalmente em Python. Está em desenvolvimento ativo desde 2024. Star-Attention está disponível sob a licença Apache-2.0. Os seus principais temas são: attention-mechanism, large-language-models, llm-inference.

Frequently asked questions

O que é Star-Attention?

Inferência LLM Eficiente sobre Longas Sequências

Star-Attention é de código aberto?

Star-Attention é um projeto de código aberto. É distribuído sob a licença Apache-2.0.

Star-Attention é gratuito?

Sim. Star-Attention é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está Star-Attention?

Star-Attention está disponível sob a licença Apache-2.0.

Em que linguagem Star-Attention está escrito?

Star-Attention é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — Star-Attention

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvidia-star-attention)](https://olud.ai/project/nvidia-star-attention.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
Medusa
Medusa: Framework Simples para Acelerar a Geração de LLM com Múltiplas Cabeças de Decodificação
2.8k · llm
partilhallm-inference
x-transformers
Um transformer completo, mas conciso, com um conjunto de recursos experimentais promissores de…
5.9k · artificial-intelligence
partilhaattention-mechanism
gpt4all
GPT4All: Execute LLMs Locais em Qualquer Dispositivo. Código aberto e disponível para uso comer…
77.4k · ai-chat
partilhallm-inference
reformer-pytorch
Reformer, o Transformer eficiente, em Pytorch
2.2k · artificial-intelligence
partilhaattention-mechanism
blast
VMs como serviço de código aberto
778 · ai-agents
partilhallm-inference
EAGLE
Implementação Oficial do EAGLE-1 (ICML'24), EAGLE-2 (EMNLP'24) e EAGLE-3 (NeurIPS'25).
2.5k · large-language-models
partilhallm-inference
PaLM-pytorch
Implementação da arquitetura Transformer específica do PaLM - Escalando Modelagem de Linguagem…
825 · artificial-general-intelligence
partilhaattention-mechanism
parti-pytorch
Implementação do Parti, a rede neural de texto para imagem baseada em atenção pura do Google, e…
537 · artificial-intelligence
partilhaattention-mechanism
lambda-networks
Implementação de LambdaNetworks, uma nova abordagem para reconhecimento de imagem que alcança S…
1.5k · artificial-intelligence
partilhaattention-mechanism
alphafold2
Para eventualmente se tornar uma implementação / replicação não oficial do Pytorch do Alphafold…
1.6k · artificial-intelligence
partilhaattention-mechanism

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.