[ICLR 2025] Modelos de codec acústico discretos SOTA com 40/75 tokens por segundo para modelagem de linguagem de áudio
Use WavTokenizer para converter áudio em um formato adequado para tarefas de processamento de linguagem.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiser[ICLR 2025] Modelos de codec acústico discretos SOTA com 40/75 tokens por segundo para modelagem de linguagem de áudio
WavTokenizer tem 1.3k estrelas no GitHub. Foi bifurcado 113 vezes. WavTokenizer é escrito principalmente em Python. Está em desenvolvimento ativo desde 2024. WavTokenizer está disponível sob a licença MIT. Os seus principais temas são: acoustic, audio-representation, codec, dac.
[ICLR 2025] Modelos de codec acústico discretos SOTA com 40/75 tokens por segundo para modelagem de linguagem de áudio
WavTokenizer é um projeto de código aberto. É distribuído sob a licença MIT.
Sim. WavTokenizer é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
WavTokenizer está disponível sob a licença MIT.
WavTokenizer é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/jishengpeng-wavtokenizer.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.