[ICLR 2025] Modelos de códec acústico discreto SOTA con 40/75 tokens por segundo para modelado de lenguaje de audio
Usa WavTokenizer para convertir audio en un formato adecuado para tareas de procesamiento de lenguaje.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quieras[ICLR 2025] Modelos de códec acústico discreto SOTA con 40/75 tokens por segundo para modelado de lenguaje de audio
WavTokenizer tiene 1.3k estrellas en GitHub. Se ha bifurcado 113 veces. WavTokenizer está escrito principalmente en Python. Se desarrolla activamente desde 2024. WavTokenizer está disponible bajo la licencia MIT. Sus temas principales son: acoustic, audio-representation, codec, dac.
[ICLR 2025] Modelos de códec acústico discreto SOTA con 40/75 tokens por segundo para modelado de lenguaje de audio
WavTokenizer es un proyecto de código abierto. Se distribuye bajo la licencia MIT.
Sí. WavTokenizer es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
WavTokenizer está disponible bajo la licencia MIT.
WavTokenizer está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/jishengpeng-wavtokenizer.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.