git clone https://github.com/coqui-ai/TTS pip install -e .[all,dev,notebooks] # Select the relevant extras

Extraits du README du projet sur GitHub. Le droit d'auteur et les licences restent la propriété des auteurs respectifs.
Coqui TTS est un outil de deep learning éprouvé pour la synthèse vocale avec de nombreux modèles et clonage vocal, y compris le modèle multilingue XTTS.
| Catégorie | Reconnaissance vocale (STT / TTS) |
| Type | Outil de synthèse vocale |
| Licence | MPL-2.0 |
| S'exécute localement | Oui |
| Construit avec | Python |
| Niveau de compétence | Intermédiaire |
| Meilleur pour | synthèse vocale et clonage vocal de haute qualité |
D'autres outils de reconnaissance vocale (stt / tts) open-source à comparer :
WhisperLa base de référence open-source d'OpenAI pour la reconnaissance vocale
faster-whisperWhisper, beaucoup plus rapide et léger
WhisperXWhisper avec horodatages de mots et diarisation
PiperTTS neural local et rapide
BarkTexte en audio avec voix et effets
F5-TTSClonage vocal zéro-shot qui convainc réellement
KokoroTTS minuscule de 82M avec une qualité étonnante
whisper.cppWhisper en pur C/C++, fonctionne partout
OpenVoiceClonez une voix et contrôlez son émotion
StyleTTS 2Synthèse vocale de niveau humain
pyannote.audioSachez qui a parlé quand
Silero VADDétectez la parole dans l'audio, instantanémentCoqui TTS est gratuit et open-source (licence MPL-2.0), vous pouvez donc l'utiliser, l'héberger vous-même et le modifier sans frais.
Oui. Coqui TTS est conçu pour fonctionner sur votre propre machine ou serveur, gardant vos données privées.
Les alternatives open-source populaires incluent Whisper, faster-whisper, WhisperX. Consultez les comparaisons ci-dessus pour choisir.
Parcourez le répertoire complet des outils, modèles et projets d'IA open-source — mis à jour quotidiennement.
Parcourez tous les outils →