Medusa: Framework Simples para Acelerar a Geração de LLM com Múltiplas Cabeças de Decodificação
Acelere a geração de modelos de linguagem grandes usando uma estrutura simples que suporta múltplos métodos de decodificação.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserMedusa: Framework Simples para Acelerar a Geração de LLM com Múltiplas Cabeças de Decodificação
Medusa tem 2.8k estrelas no GitHub. Foi bifurcado 203 vezes. Medusa é escrito principalmente em Jupyter Notebook. Está em desenvolvimento ativo desde 2023. Medusa está disponível sob a licença Apache-2.0. Os seus principais temas são: llm, llm-inference.
Medusa: Framework Simples para Acelerar a Geração de LLM com Múltiplas Cabeças de Decodificação
Medusa é um projeto de código aberto. É distribuído sob a licença Apache-2.0.
Sim. Medusa é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
Medusa está disponível sob a licença Apache-2.0.
Medusa é escrito principalmente em Jupyter Notebook.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://olud.ai/project/fasterdecoding-medusa.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.