Python

F5-TTS

Clonage vocal zéro-shot qui convainc réellement
par SWivid · MIT
15 178étoiles2 206forksPythonlangue48 il y a quelques joursdernière poussée
Reconnaissance vocale (STT / TTS)Synthèse vocale (modèle)MITS'exécute localementPythonIntermédiaire

Depuis le README

Installer
pip install pre-commit
pre-commit install

Extraits du README du projet sur GitHub. Le droit d'auteur et les licences restent la propriété des auteurs respectifs.

Un nombre élevé signifie généralement que le projet est fortement examiné. Un nombre faible signifie généralement qu'il est peu examiné — cela ne veut pas dire qu'il est sûr.
Aucun signal d'activité publique pour cet outil — il n'a pas de dépôt ouvert que nous pouvons mesurer.
Olud Pulse ⓘ ★★★★★★★★★★ /100 signaux suivis
🐳 téléchargements Docker 📦 téléchargements PyPI / mois 📦 téléchargements npm / mois 🚀 Dernière version ·
Visitez le site →Voir sur GitHub

Qu'est-ce que F5-TTS ?

F5-TTS est un TTS à diffusion-transformateur qui clone une voix à partir de quelques secondes d'audio avec une prosodie naturelle, entièrement local et suffisamment rapide pour un usage pratique.

Pourquoi les gens choisissent F5-TTS

F5-TTS en un coup d'œil

CatégorieReconnaissance vocale (STT / TTS)
TypeSynthèse vocale (modèle)
LicenceMIT
S'exécute localementOui
Construit avecPython
Niveau de compétenceIntermédiaire
Meilleur pourclonage vocal local de haute qualité
Voir les statistiques et l'activité GitHub

Alternatives open-source à F5-TTS

D'autres outils de reconnaissance vocale (stt / tts) open-source à comparer :

WhisperLa base de référence open-source d'OpenAI pour la reconnaissance vocalefaster-whisperWhisper, beaucoup plus rapide et légerWhisperXWhisper avec horodatages de mots et diarisationPiperTTS neural local et rapideCoqui TTSTTS par apprentissage profond avec clonage de voixBarkTexte en audio avec voix et effetsKokoroTTS minuscule de 82M avec une qualité étonnanteVozoDoubler la vidéo avec la voix clonée du locuteurwhisper.cppWhisper en pur C/C++, fonctionne partoutOpenVoiceClonez une voix et contrôlez son émotionStyleTTS 2Synthèse vocale de niveau humainpyannote.audioSachez qui a parlé quandSilero VADDétectez la parole dans l'audio, instantanément

F5-TTS en tête-à-tête

F5-TTS vs WhisperF5-TTS vs faster-whisperF5-TTS vs WhisperXF5-TTS vs PiperF5-TTS vs Coqui TTSF5-TTS vs BarkF5-TTS vs KokoroF5-TTS vs VozoF5-TTS vs whisper.cppF5-TTS vs OpenVoiceF5-TTS vs StyleTTS 2F5-TTS vs pyannote.audioF5-TTS vs Silero VAD

FAQ

F5-TTS est-il gratuit ?

F5-TTS est gratuit et open-source (licence MIT), vous pouvez donc l'utiliser, l'héberger vous-même et le modifier sans frais.

Puis-je exécuter F5-TTS localement ?

Oui. F5-TTS est conçu pour fonctionner sur votre propre machine ou serveur, gardant vos données privées.

Quelle est la meilleure alternative à F5-TTS ?

Les alternatives open-source populaires incluent Whisper, faster-whisper, WhisperX. Consultez les comparaisons ci-dessus pour choisir.

Explorez plus d'IA open-source

Parcourez le répertoire complet des outils, modèles et projets d'IA open-source — mis à jour quotidiennement.

Parcourez tous les outils →