Python

F5-TTS

Clonación de voz en cero disparos que realmente convence
por SWivid · MIT
15 178stars2 206forksPythonidioma48 hace díasúltima actualización
Reconocimiento de voz (STT / TTS)Texto a voz (modelo)MITEjecuta localmentePythonIntermedio

Del README

Instalar
pip install pre-commit
pre-commit install

Extractos del README del proyecto sobre GitHub. Los derechos de autor y las licencias permanecen con los respectivos autores.

Un alto conteo generalmente significa que el proyecto es examinado en profundidad. Un bajo conteo generalmente significa que se examina poco — no que sea seguro.
No hay señales de actividad pública para esta herramienta — no tiene un repositorio abierto que podamos medir.
Olud Pulse ⓘ ★★★★★★★★★★ /100 señales rastreadas
🐳 descargas de Docker 📦 descargas de PyPI / mes 📦 descargas de npm / mes 🚀 Última versión ·
Visitar sitio web →Ver en GitHub

¿Qué es F5-TTS?

F5-TTS es un TTS de transformador de difusión que clona una voz a partir de unos pocos segundos de audio con prosodia natural, totalmente local y lo suficientemente rápido para un uso práctico.

Por qué la gente elige F5-TTS

F5-TTS en un vistazo

CategoríaReconocimiento de voz (STT / TTS)
TipoTexto a voz (modelo)
LicenciaMIT
Ejecuta localmente
Construido conPython
Nivel de habilidadIntermedio
Mejor paraclonación de voz local de alta calidad
Vea estadísticas y actividad de GitHub

Alternativas de código abierto a F5-TTS

Otras herramientas de voz (stt / tts) de código abierto que vale la pena comparar:

WhisperBase de referencia de OpenAI para conversión de voz a textofaster-whisperWhisper, mucho más rápido y ligeroWhisperXWhisper más marcas de tiempo de palabras y diarizaciónPiperTexto a voz neural rápida y localCoqui TTSTTS de aprendizaje profundo con clonación de vozBarkTexto a audio con voces y efectosKokoroPequeño TTS de 82M con calidad asombrosaVozoDoble el video con la voz clonada del propio hablantewhisper.cppWhisper en C/C++ puro, funciona en cualquier lugarOpenVoiceClona una voz y controla su emociónStyleTTS 2Síntesis de voz a nivel humanopyannote.audioSabe quién habló cuándoSilero VADDetecta el habla en audio, instantáneamente

F5-TTS cara a cara

F5-TTS vs WhisperF5-TTS vs faster-whisperF5-TTS vs WhisperXF5-TTS vs PiperF5-TTS vs Coqui TTSF5-TTS vs BarkF5-TTS vs KokoroF5-TTS vs VozoF5-TTS vs whisper.cppF5-TTS vs OpenVoiceF5-TTS vs StyleTTS 2F5-TTS vs pyannote.audioF5-TTS vs Silero VAD

Preguntas frecuentes

¿Es F5-TTS gratuito?

F5-TTS es gratuito y de código abierto (licencia MIT), por lo que puedes usarlo, alojarlo y modificarlo sin costo alguno.

¿Puedo ejecutar F5-TTS localmente?

Sí. F5-TTS está diseñado para ejecutarse en tu propia máquina o servidor, manteniendo tus datos privados.

¿Cuál es la mejor alternativa a F5-TTS?

Las alternativas populares de código abierto incluyen Whisper, faster-whisper, WhisperX. Consulta las comparaciones anteriores para elegir.

Explora más IA de código abierto

Navega por el directorio completo de herramientas, modelos y proyectos de IA de código abierto, actualizado diariamente.

Navega todas las herramientas →