Code und vortrainierte Modelle für das Interspeech 2023-Papier "Whisper-AT: Noise-Robust Automatic Speech Recognizers are Also Strong Audio Event Taggers"
Verwenden Sie vortrainierte Modelle, um Sprache zu erkennen und Audioereignisse zu kennzeichnen, um die Audioverarbeitungskapazitäten für verschiedene Anwendungen zu verbessern.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbarCode und vortrainierte Modelle für das Interspeech 2023-Papier "Whisper-AT: Noise-Robust Automatic Speech Recognizers are Also Strong Audio Event Taggers"
whisper-at hat 421 Sterne auf GitHub. Es wurde 36-mal geforkt. whisper-at ist hauptsächlich in Python geschrieben. Es wird seit 2023 aktiv entwickelt. whisper-at ist unter der BSD-2-Clause-Lizenz verfügbar. Die Hauptthemen sind: audio, audio-classification, audio-processing, audio-tagging.
Code und vortrainierte Modelle für das Interspeech 2023-Papier "Whisper-AT: Noise-Robust Automatic Speech Recognizers are Also Strong Audio Event Taggers"
whisper-at ist ein Open-Source-Projekt. Es wird unter der BSD-2-Clause-Lizenz veröffentlicht.
Ja. whisper-at ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
whisper-at ist unter der BSD-2-Clause-Lizenz verfügbar.
whisper-at ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://olud.ai/project/yuangongnd-whisper-at.html)
Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.