FlashInfer: Biblioteca Kernel para Servir LLM
Utiliza código optimizado para mejorar el rendimiento de los modelos de IA en diversas tarjetas gráficas durante la inferencia.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasFlashInfer: Biblioteca Kernel para Servir LLM
flashinfer tiene 6.1k estrellas en GitHub. Se ha bifurcado 1.2k veces. flashinfer está escrito principalmente en Python. Se desarrolla activamente desde 2023. flashinfer está disponible bajo la licencia Apache-2.0. Sus temas principales son: attention, cuda, distributed-inference, gpu.
FlashInfer: Biblioteca Kernel para Servir LLM
flashinfer es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. flashinfer es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
flashinfer está disponible bajo la licencia Apache-2.0.
flashinfer está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/flashinfer-ai-flashinfer.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.