Início Projetos Star-Attention
Star-Attention
Python

Star-Attention

Inferência LLM Eficiente sobre Longas Sequências

por NVIDIA · GitHub
Estrelas
Forks
Licença
Criado
Último commit
Linguagem
attention-mechanismlarge-language-modelsllm-inferenceApache-2.0Python
Ver no GitHub
Em palavras simples

Execute modelos de IA de sequência longa de forma mais eficiente com Star Attention, acelerando significativamente seus tempos de resposta.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
Star-Attention — GitHub preview card
📈 Histórico de estrelas
392391
2026-07-202026-08-31
📈 Acompanhe Star-Attention

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

Inferência LLM Eficiente sobre Longas Sequências

Star-Attention tem 392 estrelas no GitHub. Foi bifurcado 24 vezes. Star-Attention é escrito principalmente em Python. Está em desenvolvimento ativo desde 2024. Star-Attention está disponível sob a licença Apache-2.0. Os seus principais temas são: attention-mechanism, large-language-models, llm-inference.

Frequently asked questions

O que é Star-Attention?

Inferência LLM Eficiente sobre Longas Sequências

Star-Attention é de código aberto?

Star-Attention é um projeto de código aberto. É distribuído sob a licença Apache-2.0.

Star-Attention é gratuito?

Sim. Star-Attention é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está Star-Attention?

Star-Attention está disponível sob a licença Apache-2.0.

Em que linguagem Star-Attention está escrito?

Star-Attention é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — Star-Attention

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvidia-star-attention)](https://olud.ai/project/nvidia-star-attention.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
Medusa
Medusa: Framework Simples para Acelerar a Geração de LLM com Múltiplas Cabeças de Decodificação
2.8k · llm
partilhallm-inference
MultiModalMamba
Uma implementação inovadora que funde ViT com Mamba em um Modelo Multi-Modal rápido, ágil e de…
473 · ai
partilhaattention-mechanism
sign-language-translator
Biblioteca e framework Python para construir tradutores personalizados para deficientes auditiv…
359 · artificial-intelligence
partilhaattention-mechanism
gpt4all
GPT4All: Execute LLMs Locais em Qualquer Dispositivo. Código aberto e disponível para uso comer…
77.4k · ai-chat
partilhallm-inference
reformer-pytorch
Reformer, o Transformer eficiente, em Pytorch
2.2k · artificial-intelligence
partilhaattention-mechanism
x-transformers
Um transformer completo, mas conciso, com um conjunto de recursos experimentais promissores de…
5.9k · artificial-intelligence
partilhaattention-mechanism
flamingo-pytorch
Implementação do 🦩 Flamingo, rede de atenção de perguntas visuais de poucos disparos de última…
1.3k · artificial-intelligence
partilhaattention-mechanism
TimeSformer-pytorch
Implementação do TimeSformer do Facebook AI, uma solução puramente baseada em atenção para clas…
729 · artificial-intelligence
partilhaattention-mechanism
nndl
邱锡鹏《神经网络与深度学习》(蒲公英书)理论书 v2 与通识版
19k · attention-mechanism
partilhaattention-mechanism
GeoTransformer
[CVPR2022] Transformador Geométrico para Registro Rápido e Robusto de Nuvens de Pontos
966 · attention-mechanism
partilhaattention-mechanism

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.