Python

pyannote.audio

Sachez qui a parlé quand
par pyannote · MIT
10 491étoiles1 100forksJupyter Notebooklangue36 il y a quelques joursdernière poussée
Reconnaissance vocale (STT / TTS)Diarisation des locuteursMITS'exécute localementPythonIntermédiaire

Depuis le README

Installer
pip install -e .[dev,testing]
pre-commit install

Extraits du README du projet sur GitHub. Le droit d'auteur et les licences restent la propriété des auteurs respectifs.

Un nombre élevé signifie généralement que le projet est fortement examiné. Un nombre faible signifie généralement qu'il est peu examiné — cela ne veut pas dire qu'il est sûr.
Aucun signal d'activité publique pour cet outil — il n'a pas de dépôt ouvert que nous pouvons mesurer.
Olud Pulse ⓘ ★★★★★★★★★★ /100 signaux suivis
🐳 téléchargements Docker 📦 téléchargements PyPI / mois 📦 téléchargements npm / mois 🚀 Dernière version ·
Visitez le site →Voir sur GitHub

Qu'est-ce que pyannote.audio ?

pyannote.audio segmente l'audio par locuteur, répondant à "qui a parlé quand" — la pièce manquante qui transforme une transcription en un compte rendu de réunion utilisable.

Pourquoi les gens choisissent pyannote.audio

pyannote.audio en un coup d'œil

CatégorieReconnaissance vocale (STT / TTS)
TypeDiarisation des locuteurs
LicenceMIT
S'exécute localementOui
Construit avecPython
Niveau de compétenceIntermédiaire
Meilleur pourtranscriptions de réunion avec plusieurs locuteurs
Voir les statistiques et l'activité GitHub

Alternatives open-source à pyannote.audio

D'autres outils de reconnaissance vocale (stt / tts) open-source à comparer :

WhisperLa base de référence open-source d'OpenAI pour la reconnaissance vocalefaster-whisperWhisper, beaucoup plus rapide et légerWhisperXWhisper avec horodatages de mots et diarisationPiperTTS neural local et rapideCoqui TTSTTS par apprentissage profond avec clonage de voixBarkTexte en audio avec voix et effetsF5-TTSClonage vocal zéro-shot qui convainc réellementKokoroTTS minuscule de 82M avec une qualité étonnanteVozoDoubler la vidéo avec la voix clonée du locuteurwhisper.cppWhisper en pur C/C++, fonctionne partoutOpenVoiceClonez une voix et contrôlez son émotionStyleTTS 2Synthèse vocale de niveau humainSilero VADDétectez la parole dans l'audio, instantanément

pyannote.audio en tête-à-tête

pyannote.audio vs Whisperpyannote.audio vs faster-whisperpyannote.audio vs WhisperXpyannote.audio vs Piperpyannote.audio vs Coqui TTSpyannote.audio vs Barkpyannote.audio vs F5-TTSpyannote.audio vs Kokoropyannote.audio vs Vozopyannote.audio vs whisper.cpppyannote.audio vs OpenVoicepyannote.audio vs StyleTTS 2pyannote.audio vs Silero VAD

FAQ

pyannote.audio est-il gratuit ?

pyannote.audio est gratuit et open-source (licence MIT), vous pouvez l'utiliser, l'héberger vous-même et le modifier sans frais.

Puis-je exécuter pyannote.audio localement ?

Oui. pyannote.audio est conçu pour fonctionner sur votre propre machine ou serveur, gardant vos données privées.

Quelle est la meilleure alternative à pyannote.audio ?

Les alternatives open-source populaires incluent Whisper, faster-whisper, WhisperX. Consultez les comparaisons ci-dessus pour choisir.

Explorez plus d'IA open-source

Parcourez le répertoire complet des outils, modèles et projets d'IA open-source — mis à jour quotidiennement.

Parcourez tous les outils →