Python

pyannote.audio

Sa chi ha parlato quando
di pyannote · MIT
10 491stelle1 100forkJupyter Notebooklingua36 giorni faultimo push
Voce (STT / TTS)Diarizzazione degli speakerMITEsegue localmentePythonIntermedio

Dal README

Installa
pip install -e .[dev,testing]
pre-commit install

Estratti dal README del progetto su GitHub. I diritti d'autore e le licenze rimangono con i rispettivi autori.

Un numero elevato di segnalazioni di solito significa che il progetto è ampiamente esaminato. Un numero basso di solito significa che è poco esaminato — non che sia sicuro.
Nessun segnale di attività pubblica per questo strumento — non ha un repository aperto che possiamo misurare.
Olud Pulse ⓘ ★★★★★★★★★★ /100 segnali tracciati
🐳 download Docker 📦 download PyPI / mese 📦 download npm / mese 🚀 Ultima versione ·
Visita il sito →Visualizza su GitHub

Cos'è pyannote.audio?

pyannote.audio segmenta l'audio per relatore, rispondendo a "chi ha parlato quando" — il pezzo mancante che trasforma una trascrizione in un record di riunione utilizzabile.

Perché le persone scelgono pyannote.audio

pyannote.audio in sintesi

CategoriaVoce (STT / TTS)
TipoDiarizzazione degli speaker
LicenzaMIT
Esegue localmente
Costruito conPython
Livello di abilitàIntermedio
Migliore pertrascrizioni di riunioni con più relatori
Vedi statistiche e attività su GitHub

Alternative open-source a pyannote.audio

Altri strumenti di trascrizione vocale (stt / tts) open-source da confrontare:

WhisperBaseline open di OpenAI per la trascrizione vocalefaster-whisperWhisper, molto più veloce e leggeroWhisperXWhisper con timestamp delle parole e diarizzazionePiperNeurale text-to-speech veloce e localeCoqui TTSTTS con deep learning e clonazione vocaleBarkTesto in audio con voci ed effettiF5-TTSClonazione vocale zero-shot che convince davveroKokoroPiccolo TTS da 82M con qualità sorprendenteVozoDoppi il video con la voce clonata del parlantewhisper.cppWhisper in puro C/C++, funziona ovunqueOpenVoiceClona una voce e controlla la sua emozioneStyleTTS 2Sintesi vocale a livello umanoSilero VADRileva la voce nell'audio, istantaneamente

pyannote.audio a confronto

pyannote.audio vs Whisperpyannote.audio vs faster-whisperpyannote.audio vs WhisperXpyannote.audio vs Piperpyannote.audio vs Coqui TTSpyannote.audio vs Barkpyannote.audio vs F5-TTSpyannote.audio vs Kokoropyannote.audio vs Vozopyannote.audio vs whisper.cpppyannote.audio vs OpenVoicepyannote.audio vs StyleTTS 2pyannote.audio vs Silero VAD

FAQ

pyannote.audio è gratuito?

pyannote.audio è gratuito e open-source (licenza MIT), quindi puoi usarlo, ospitarlo autonomamente e modificarlo senza costi.

Posso eseguire pyannote.audio localmente?

Sì. pyannote.audio è progettato per funzionare sulla tua macchina o server, mantenendo i tuoi dati privati.

Qual è la migliore alternativa a pyannote.audio?

Le popolari alternative open-source includono Whisper, faster-whisper, WhisperX. Consulta i confronti sopra per scegliere.

Esplora più AI open-source

Sfoglia l'intero elenco di strumenti, modelli e progetti AI open-source — aggiornato quotidianamente.

Sfoglia tutti gli strumenti →