Accueil Projets SpeechT5
SpeechT5
Python

SpeechT5

Pré-formation unifiée Modal Parole-Texte pour le Traitement du Langage Parlé

par microsoft · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Langue
speech-pretrainingspeech-recognitionspeech-synthesisMITPython
Voir sur GitHub
En termes simples

Entraînez des modèles pour comprendre et traiter le langage parlé, convertissant la parole en texte et vice versa.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
SpeechT5 — GitHub preview card
📈 Historique des étoiles
1 4481 447
2026-07-202026-08-31
📈 Suivez SpeechT5

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Pré-formation unifiée Modal Parole-Texte pour le Traitement du Langage Parlé

SpeechT5 compte 1.4k étoiles sur GitHub. Il a été forké 134 fois. SpeechT5 est écrit principalement en Python. Il est développé activement depuis 2022. SpeechT5 est disponible sous licence MIT. Ses principaux thèmes sont : speech-pretraining, speech-recognition, speech-synthesis, speech-text-pretraining.

Frequently asked questions

Qu'est-ce que SpeechT5 ?

Pré-formation unifiée Modal Parole-Texte pour le Traitement du Langage Parlé

SpeechT5 est-il open source ?

SpeechT5 est un projet open source. Il est distribué sous licence MIT.

SpeechT5 est-il gratuit ?

Oui. SpeechT5 est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est SpeechT5 ?

SpeechT5 est disponible sous licence MIT.

Dans quel langage SpeechT5 est-il écrit ?

SpeechT5 est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — SpeechT5

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=microsoft-speecht5)](https://olud.ai/project/microsoft-speecht5.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
local-talking-llm
Un LLM parlant qui fonctionne sur votre propre ordinateur sans avoir besoin d'internet.
878 · chatbot
partagespeech-synthesisspeech-recognition
Speech-Backbones
Ceci est le dépôt principal de la technologie de parole open-source par le laboratoire Huawei N…
604 · speech-processing
partagespeech-synthesisspeech-recognition
Irene-Voice-Assistant
Ирина - русский голосовой ассистент для работы оффлайн. Поддерживает скиллы через плагины.
1.1k · python
partagespeech-synthesisspeech-recognition
speech-recognition-uk
🇺🇦 Reconnaissance et synthèse vocale pour l'ukrainien
439 · speech
partagespeech-synthesisspeech-recognition
artyom.js
Une bibliothèque javascript de contrôle vocal - commandes vocales - reconnaissance vocale et sy…
1.3k · recognition
partagespeech-synthesisspeech-recognition
Ming-UniAudio
Ming-UniAudio : LLM de Parole pour la Compréhension, la Génération et l'Édition Unifiées
450 · speech
partagespeech-synthesisspeech-recognition
Freeze-Omni
✨✨Freeze-Omni : Un modèle de dialogue intelligent et à faible latence de parole à parole avec L…
395 · large-language-models
partagespeech-synthesisspeech-recognition
kaldi-gstreamer-server
Serveur de reconnaissance vocale en temps réel à duplex intégral, basé sur l'outil Kaldi et le…
1.1k · speech-recognition
partagespeech-recognition
FastASR
这是一个用C++实现ASR推理的项目,它依赖很少,安装也很简单,推理速度很快,在树莓派4B等ARM平台也可以流畅的运行。 支持的模型是由Google的Transformer模型中优化而来,数…
553 · speech-recognition
partagespeech-recognition
dragonfly
Cadre de reconnaissance vocale permettant un puissant scripting et une extension basés sur Pyth…
413 · python
partagespeech-recognition

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.