Startseite Projekte SpeechT5
SpeechT5
Python

SpeechT5

Vereinigte Modalität Sprach-Text Vortraining für die Verarbeitung gesprochener Sprache

von microsoft · GitHub
Sterne
Forks
Lizenz
Erstellt
Letzter Commit
Sprache
speech-pretrainingspeech-recognitionspeech-synthesisMITPython
Auf GitHub ansehen
In einfachen Worten

Trainieren Sie Modelle, um gesprochene Sprache zu verstehen und zu verarbeiten, indem Sie Sprache in Text und umgekehrt umwandeln.

Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
SpeechT5 — GitHub preview card
📈 Sternhistorie
1 4481 447
2026-07-202026-08-31
📈 SpeechT5 verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

Vereinigte Modalität Sprach-Text Vortraining für die Verarbeitung gesprochener Sprache

SpeechT5 hat 1.4k Sterne auf GitHub. Es wurde 134-mal geforkt. SpeechT5 ist hauptsächlich in Python geschrieben. Es wird seit 2022 aktiv entwickelt. SpeechT5 ist unter der MIT-Lizenz verfügbar. Die Hauptthemen sind: speech-pretraining, speech-recognition, speech-synthesis, speech-text-pretraining.

Frequently asked questions

Was ist SpeechT5?

Vereinigte Modalität Sprach-Text Vortraining für die Verarbeitung gesprochener Sprache

Ist SpeechT5 Open Source?

SpeechT5 ist ein Open-Source-Projekt. Es wird unter der MIT-Lizenz veröffentlicht.

Ist SpeechT5 kostenlos?

Ja. SpeechT5 ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

Unter welcher Lizenz steht SpeechT5?

SpeechT5 ist unter der MIT-Lizenz verfügbar.

In welcher Sprache ist SpeechT5 geschrieben?

SpeechT5 ist hauptsächlich in Python geschrieben.

🏅 Wartender dieses Projekts?
olud.ai badge — SpeechT5

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![olud.ai](https://olud.ai/badge.php?tool=microsoft-speecht5)](https://olud.ai/project/microsoft-speecht5.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →
local-talking-llm
Ein sprechendes LLM, das auf Ihrem eigenen Computer läuft, ohne das Internet zu benötigen.
878 · chatbot
teiltspeech-synthesisspeech-recognition
Speech-Backbones
Dies ist das Hauptrepository der Open-Source-Sprachtechnologie von Huawei Noah's Ark Lab.
604 · speech-processing
teiltspeech-synthesisspeech-recognition
Irene-Voice-Assistant
Ирина - русский голосовой ассистент для работы оффлайн. Поддерживает скиллы через плагины.
1.1k · python
teiltspeech-synthesisspeech-recognition
speech-recognition-uk
🇺🇦 Sprach- und Syntheseerkennung für Ukrainisch
439 · speech
teiltspeech-synthesisspeech-recognition
artyom.js
Eine Sprachsteuerung - Sprachbefehle - Sprach- und Sprachsynthese-JavaScript-Bibliothek. Erstel…
1.3k · recognition
teiltspeech-synthesisspeech-recognition
Ming-UniAudio
Ming-UniAudio: Sprach-LLM für gemeinsames Verständnis, Generierung und Bearbeitung mit einheitl…
450 · speech
teiltspeech-synthesisspeech-recognition
Freeze-Omni
✨✨Freeze-Omni: Ein intelligentes und latenzarmes Sprach-zu-Sprache-Dialogmodell mit gefrorenem…
395 · large-language-models
teiltspeech-synthesisspeech-recognition
kaldi-gstreamer-server
Echtzeit-Voll-Duplex-Spracherkennungsserver, basierend auf dem Kaldi-Toolkit und dem GStreamer-…
1.1k · speech-recognition
teiltspeech-recognition
FastASR
这是一个用C++实现ASR推理的项目,它依赖很少,安装也很简单,推理速度很快,在树莓派4B等ARM平台也可以流畅的运行。 支持的模型是由Google的Transformer模型中优化而来,数…
553 · speech-recognition
teiltspeech-recognition
dragonfly
Spracherkennungs-Framework, das leistungsstarkes, Python-basiertes Scripting und Erweiterungen…
413 · python
teiltspeech-recognition

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.