Home Progetti SpeechT5
SpeechT5
Python

SpeechT5

Pre-Addestramento Unificato Modalità Voce-Testo per l'Elaborazione del Linguaggio Parlato

di microsoft · GitHub
Stelle
Fork
Licenza
Creato
Ultimo commit
Lingua
speech-pretrainingspeech-recognitionspeech-synthesisMITPython
Visualizza su GitHub
In parole semplici

Allena modelli per comprendere e elaborare il linguaggio parlato, convertendo il parlato in testo e viceversa.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
SpeechT5 — GitHub preview card
📈 Storia delle stelle
1 4481 447
2026-07-202026-08-31
📈 Segui SpeechT5

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Pre-Addestramento Unificato Modalità Voce-Testo per l'Elaborazione del Linguaggio Parlato

SpeechT5 ha 1.4k stelle su GitHub. È stato forkato 134 volte. SpeechT5 è scritto principalmente in Python. È in sviluppo attivo dal 2022. SpeechT5 è disponibile con licenza MIT. I suoi temi principali sono: speech-pretraining, speech-recognition, speech-synthesis, speech-text-pretraining.

Frequently asked questions

Che cos'è SpeechT5?

Pre-Addestramento Unificato Modalità Voce-Testo per l'Elaborazione del Linguaggio Parlato

SpeechT5 è open source?

SpeechT5 è un progetto open source. È rilasciato con licenza MIT.

SpeechT5 è gratuito?

Sì. SpeechT5 è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è SpeechT5?

SpeechT5 è disponibile con licenza MIT.

In quale linguaggio è scritto SpeechT5?

SpeechT5 è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — SpeechT5

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=microsoft-speecht5)](https://olud.ai/project/microsoft-speecht5.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
local-talking-llm
Un LLM parlante che gira sul tuo computer senza bisogno di internet.
878 · chatbot
condividespeech-synthesisspeech-recognition
Speech-Backbones
Questo è il repository principale della tecnologia di riconoscimento vocale open-source di Huaw…
604 · speech-processing
condividespeech-synthesisspeech-recognition
Irene-Voice-Assistant
Ирина - русский голосовой ассистент для работы оффлайн. Поддерживает скиллы через плагины.
1.1k · python
condividespeech-synthesisspeech-recognition
speech-recognition-uk
🇺🇦 Riconoscimento e Sintesi Vocale per l'Ucraino
439 · speech
condividespeech-synthesisspeech-recognition
artyom.js
Una libreria javascript per il controllo vocale - comandi vocali - riconoscimento vocale e sint…
1.3k · recognition
condividespeech-synthesisspeech-recognition
Ming-UniAudio
Ming-UniAudio: LLM per la Comprensione, Generazione e Modifica del Parlato con Rappresentazione…
450 · speech
condividespeech-synthesisspeech-recognition
Freeze-Omni
✨✨Freeze-Omni: Un modello di dialogo speech-to-speech intelligente e a bassa latenza con LLM co…
395 · large-language-models
condividespeech-synthesisspeech-recognition
kaldi-gstreamer-server
Server di riconoscimento vocale full-duplex in tempo reale, basato sul toolkit Kaldi e sul fram…
1.1k · speech-recognition
condividespeech-recognition
FastASR
Questo è un progetto di inferenza ASR implementato in C++, che ha poche dipendenze, è facile da…
553 · speech-recognition
condividespeech-recognition
dragonfly
Framework di riconoscimento vocale che consente scripting e estensione potenti basati su Python…
413 · python
condividespeech-recognition

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.