Inicio Proyectos Star-Attention
Star-Attention

Star-Attention

por NVIDIA · GitHub

Inferencia eficiente de LLM sobre Secuencias Largas

Ver en GitHub
⭐ Estrellas
🍴 Ramas
📜 Licencia
Uso comercial permitido
📅 Creado
🔄 Último commit
🏷️ Categoría
💻 Lenguaje
¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
Star-Attention — GitHub preview card
📈 Historial de estrellas
392391
2026-07-202026-07-29
📈 Sigue Star-Attention

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Inferencia eficiente de LLM sobre Secuencias Largas

Star-Attention tiene 391 estrellas en GitHub. Se ha bifurcado 24 veces. Star-Attention está escrito principalmente en Python. Se desarrolla activamente desde 2024. Star-Attention está disponible bajo la licencia Apache-2.0. Sus temas principales son: attention-mechanism, large-language-models, llm-inference.

Frequently asked questions

¿Qué es Star-Attention?

Inferencia eficiente de LLM sobre Secuencias Largas

¿Star-Attention es de código abierto?

Star-Attention es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.

¿Star-Attention es gratis?

Sí. Star-Attention es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está Star-Attention?

Star-Attention está disponible bajo la licencia Apache-2.0.

¿En qué lenguaje está escrito Star-Attention?

Star-Attention está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
OpenSourceAI badge — Star-Attention

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=nvidia-star-attention)](https://opensourceai.tech/project/nvidia-star-attention.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
Medusa
Medusa: Marco Simple para Acelerar la Generación de LLM con Múltiples Cabezas de Decodificación
2.8k · llm
compartellm-inference
x-transformers
Un transformador conciso pero completo con atención total y un conjunto de características expe…
5.9k · artificial-intelligence
comparteattention-mechanism
gpt4all
GPT4All: Ejecuta LLMs locales en cualquier dispositivo. Código abierto y disponible para uso co…
77.4k · ai-chat
compartellm-inference
reformer-pytorch
Reformer, el Transformer eficiente, en Pytorch
2.2k · artificial-intelligence
comparteattention-mechanism
blast
VMs como servicio de código abierto
778 · ai-agents
compartellm-inference
EAGLE
Implementación oficial de EAGLE-1 (ICML'24), EAGLE-2 (EMNLP'24) y EAGLE-3 (NeurIPS'25).
2.5k · large-language-models
compartellm-inference
PaLM-pytorch
Implementación de la arquitectura Transformer específica de PaLM - Escalando Modelado de Lengua…
825 · artificial-general-intelligence
comparteattention-mechanism
parti-pytorch
Implementación de Parti, la red neuronal de texto a imagen basada en atención pura de Google, e…
537 · artificial-intelligence
comparteattention-mechanism
lambda-networks
Implementación de LambdaNetworks, un nuevo enfoque para el reconocimiento de imágenes que alcan…
1.5k · artificial-intelligence
comparteattention-mechanism
alphafold2
Para eventualmente convertirse en una implementación / replicación no oficial de Pytorch de Alp…
1.6k · artificial-intelligence
comparteattention-mechanism

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.