[ICLR 2025] Modelli codec acustici discreti SOTA con 40/75 token al secondo per la modellazione del linguaggio audio
Usa WavTokenizer per convertire l'audio in un formato adatto per compiti di elaborazione del linguaggio.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoi[ICLR 2025] Modelli codec acustici discreti SOTA con 40/75 token al secondo per la modellazione del linguaggio audio
WavTokenizer ha 1.3k stelle su GitHub. È stato forkato 113 volte. WavTokenizer è scritto principalmente in Python. È in sviluppo attivo dal 2024. WavTokenizer è disponibile con licenza MIT. I suoi temi principali sono: acoustic, audio-representation, codec, dac.
[ICLR 2025] Modelli codec acustici discreti SOTA con 40/75 token al secondo per la modellazione del linguaggio audio
WavTokenizer è un progetto open source. È rilasciato con licenza MIT.
Sì. WavTokenizer è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
WavTokenizer è disponibile con licenza MIT.
WavTokenizer è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://opensourceai.tech/project/jishengpeng-wavtokenizer.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.