[ICLR 2025] SOTA diskrete akustische Codec-Modelle mit 40/75 Tokens pro Sekunde für Audio-Sprachmodellierung
Verwende WavTokenizer, um Audio in ein für Sprachverarbeitungsaufgaben geeignetes Format zu konvertieren.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbar[ICLR 2025] SOTA diskrete akustische Codec-Modelle mit 40/75 Tokens pro Sekunde für Audio-Sprachmodellierung
WavTokenizer hat 1.3k Sterne auf GitHub. Es wurde 113-mal geforkt. WavTokenizer ist hauptsächlich in Python geschrieben. Es wird seit 2024 aktiv entwickelt. WavTokenizer ist unter der MIT-Lizenz verfügbar. Die Hauptthemen sind: acoustic, audio-representation, codec, dac.
[ICLR 2025] SOTA diskrete akustische Codec-Modelle mit 40/75 Tokens pro Sekunde für Audio-Sprachmodellierung
WavTokenizer ist ein Open-Source-Projekt. Es wird unter der MIT-Lizenz veröffentlicht.
Ja. WavTokenizer ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
WavTokenizer ist unter der MIT-Lizenz verfügbar.
WavTokenizer ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://opensourceai.tech/project/jishengpeng-wavtokenizer.html)
Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.