Inicio Proyectos Star-Attention
Star-Attention
Python

Star-Attention

Inferencia eficiente de LLM sobre Secuencias Largas

por NVIDIA · GitHub
Estrellas
Ramas
Licencia
Creado
Último commit
Lenguaje
attention-mechanismlarge-language-modelsllm-inferenceApache-2.0Python
Ver en GitHub
En palabras simples

Ejecuta modelos de IA de secuencia larga de manera más eficiente con Star Attention, acelerando significativamente sus tiempos de respuesta.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
Star-Attention — GitHub preview card
📈 Historial de estrellas
392391
2026-07-202026-08-31
📈 Sigue Star-Attention

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Inferencia eficiente de LLM sobre Secuencias Largas

Star-Attention tiene 392 estrellas en GitHub. Se ha bifurcado 24 veces. Star-Attention está escrito principalmente en Python. Se desarrolla activamente desde 2024. Star-Attention está disponible bajo la licencia Apache-2.0. Sus temas principales son: attention-mechanism, large-language-models, llm-inference.

Frequently asked questions

¿Qué es Star-Attention?

Inferencia eficiente de LLM sobre Secuencias Largas

¿Star-Attention es de código abierto?

Star-Attention es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.

¿Star-Attention es gratis?

Sí. Star-Attention es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está Star-Attention?

Star-Attention está disponible bajo la licencia Apache-2.0.

¿En qué lenguaje está escrito Star-Attention?

Star-Attention está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — Star-Attention

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvidia-star-attention)](https://olud.ai/project/nvidia-star-attention.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
Medusa
Medusa: Marco Simple para Acelerar la Generación de LLM con Múltiples Cabezas de Decodificación
2.8k · llm
compartellm-inference
MultiModalMamba
Una implementación novedosa de fusión de ViT con Mamba en un modelo multimodal rápido, ágil y d…
473 · ai
comparteattention-mechanism
sign-language-translator
Biblioteca y marco de Python para construir traductores personalizados para personas con discap…
359 · artificial-intelligence
comparteattention-mechanism
gpt4all
GPT4All: Ejecuta LLMs locales en cualquier dispositivo. Código abierto y disponible para uso co…
77.4k · ai-chat
compartellm-inference
reformer-pytorch
Reformer, el Transformer eficiente, en Pytorch
2.2k · artificial-intelligence
comparteattention-mechanism
x-transformers
Un transformador conciso pero completo con atención total y un conjunto de características expe…
5.9k · artificial-intelligence
comparteattention-mechanism
flamingo-pytorch
Implementación de 🦩 Flamingo, red de atención de vanguardia para preguntas visuales de pocos di…
1.3k · artificial-intelligence
comparteattention-mechanism
TimeSformer-pytorch
Implementación de TimeSformer de Facebook AI, una solución puramente basada en atención para la…
729 · artificial-intelligence
comparteattention-mechanism
nndl
邱锡鹏《神经网络与深度学习》(蒲公英书)理论书 v2 与通识版
19k · attention-mechanism
comparteattention-mechanism
GeoTransformer
[CVPR2022] Transformador Geométrico para Registro Rápido y Robusto de Nubes de Puntos
966 · attention-mechanism
comparteattention-mechanism

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.