Python

StyleTTS 2

Synthèse vocale de niveau humain
par yl4579 · MIT
6 340étoiles701forksPythonlangue760 il y a quelques joursdernière poussée
Reconnaissance vocale (STT / TTS)Synthèse vocaleMITS'exécute localementPythonAvancé

Depuis le README

Installer
git clone https://github.com/yl4579/StyleTTS2.git
cd StyleTTS2

Extraits du README du projet sur GitHub. Le droit d'auteur et les licences restent la propriété des auteurs respectifs.

Un nombre élevé signifie généralement que le projet est fortement examiné. Un nombre faible signifie généralement qu'il est peu examiné — cela ne veut pas dire qu'il est sûr.
Aucun signal d'activité publique pour cet outil — il n'a pas de dépôt ouvert que nous pouvons mesurer.
Olud Pulse ⓘ ★★★★★★★★★★ /100 signaux suivis
🐳 téléchargements Docker 📦 téléchargements PyPI / mois 📦 téléchargements npm / mois 🚀 Dernière version ·
Visitez le site →Voir sur GitHub

Qu'est-ce que StyleTTS 2 ?

StyleTTS 2 atteint une qualité proche de l'humain grâce à la diffusion de style et à l'entraînement adversarial, et peut cloner une voix à partir de quelques secondes d'audio.

Pourquoi les gens choisissent StyleTTS 2

StyleTTS 2 en un coup d'œil

CatégorieReconnaissance vocale (STT / TTS)
TypeSynthèse vocale
LicenceMIT
S'exécute localementOui
Construit avecPython
Niveau de compétenceAvancé
Meilleur pourla meilleure qualité de TTS open
Voir les statistiques et l'activité GitHub

Alternatives open-source à StyleTTS 2

D'autres outils de reconnaissance vocale (stt / tts) open-source à comparer :

WhisperLa base de référence open-source d'OpenAI pour la reconnaissance vocalefaster-whisperWhisper, beaucoup plus rapide et légerWhisperXWhisper avec horodatages de mots et diarisationPiperTTS neural local et rapideCoqui TTSTTS par apprentissage profond avec clonage de voixBarkTexte en audio avec voix et effetsF5-TTSClonage vocal zéro-shot qui convainc réellementKokoroTTS minuscule de 82M avec une qualité étonnanteVozoDoubler la vidéo avec la voix clonée du locuteurwhisper.cppWhisper en pur C/C++, fonctionne partoutOpenVoiceClonez une voix et contrôlez son émotionpyannote.audioSachez qui a parlé quandSilero VADDétectez la parole dans l'audio, instantanément

StyleTTS 2 en tête-à-tête

StyleTTS 2 vs WhisperStyleTTS 2 vs faster-whisperStyleTTS 2 vs WhisperXStyleTTS 2 vs PiperStyleTTS 2 vs Coqui TTSStyleTTS 2 vs BarkStyleTTS 2 vs F5-TTSStyleTTS 2 vs KokoroStyleTTS 2 vs VozoStyleTTS 2 vs whisper.cppStyleTTS 2 vs OpenVoiceStyleTTS 2 vs pyannote.audioStyleTTS 2 vs Silero VAD

FAQ

StyleTTS 2 est-il gratuit ?

StyleTTS 2 est gratuit et open-source (licence MIT), vous pouvez l'utiliser, l'héberger vous-même et le modifier sans frais.

Puis-je exécuter StyleTTS 2 localement ?

Oui. StyleTTS 2 est conçu pour fonctionner sur votre propre machine ou serveur, gardant vos données privées.

Quelle est la meilleure alternative à StyleTTS 2 ?

Les alternatives open-source populaires incluent Whisper, faster-whisper, WhisperX. Consultez les comparaisons ci-dessus pour choisir.

Explorez plus d'IA open-source

Parcourez le répertoire complet des outils, modèles et projets d'IA open-source — mis à jour quotidiennement.

Parcourez tous les outils →