Medusa: Marco Simple para Acelerar la Generación de LLM con Múltiples Cabezas de Decodificación
Acelera la generación de modelos de lenguaje grande utilizando un marco simple que admite múltiples métodos de decodificación.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasMedusa: Marco Simple para Acelerar la Generación de LLM con Múltiples Cabezas de Decodificación
Medusa tiene 2.8k estrellas en GitHub. Se ha bifurcado 203 veces. Medusa está escrito principalmente en Jupyter Notebook. Se desarrolla activamente desde 2023. Medusa está disponible bajo la licencia Apache-2.0. Sus temas principales son: llm, llm-inference.
Medusa: Marco Simple para Acelerar la Generación de LLM con Múltiples Cabezas de Decodificación
Medusa es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. Medusa es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
Medusa está disponible bajo la licencia Apache-2.0.
Medusa está escrito principalmente en Jupyter Notebook.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/fasterdecoding-medusa.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.