Inicio Proyectos SpeechT5
SpeechT5
Python

SpeechT5

Pre-entrenamiento de Texto-Speech Unificado para Procesamiento de Lenguaje Hablado

por microsoft · GitHub
Estrellas
Ramas
Licencia
Creado
Último commit
Lenguaje
speech-pretrainingspeech-recognitionspeech-synthesisMITPython
Ver en GitHub
En palabras simples

Entrena modelos para entender y procesar el lenguaje hablado, convirtiendo el habla en texto y viceversa.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
SpeechT5 — GitHub preview card
📈 Historial de estrellas
1 4481 447
2026-07-202026-08-31
📈 Sigue SpeechT5

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Pre-entrenamiento de Texto-Speech Unificado para Procesamiento de Lenguaje Hablado

SpeechT5 tiene 1.4k estrellas en GitHub. Se ha bifurcado 134 veces. SpeechT5 está escrito principalmente en Python. Se desarrolla activamente desde 2022. SpeechT5 está disponible bajo la licencia MIT. Sus temas principales son: speech-pretraining, speech-recognition, speech-synthesis, speech-text-pretraining.

Frequently asked questions

¿Qué es SpeechT5?

Pre-entrenamiento de Texto-Speech Unificado para Procesamiento de Lenguaje Hablado

¿SpeechT5 es de código abierto?

SpeechT5 es un proyecto de código abierto. Se distribuye bajo la licencia MIT.

¿SpeechT5 es gratis?

Sí. SpeechT5 es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está SpeechT5?

SpeechT5 está disponible bajo la licencia MIT.

¿En qué lenguaje está escrito SpeechT5?

SpeechT5 está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — SpeechT5

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=microsoft-speecht5)](https://olud.ai/project/microsoft-speecht5.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
local-talking-llm
Un LLM hablante que se ejecuta en tu propia computadora sin necesidad de internet.
878 · chatbot
compartespeech-synthesisspeech-recognition
Speech-Backbones
Este es el repositorio principal de tecnología de voz de código abierto por el Laboratorio Noah…
604 · speech-processing
compartespeech-synthesisspeech-recognition
Irene-Voice-Assistant
Ирина - русский голосовой ассистент для работы оффлайн. Поддерживает скиллы через плагины.
1.1k · python
compartespeech-synthesisspeech-recognition
speech-recognition-uk
🇺🇦 Reconocimiento y Síntesis de Voz para Ucraniano
439 · speech
compartespeech-synthesisspeech-recognition
artyom.js
Una biblioteca de javascript para control por voz - comandos de voz - reconocimiento de voz y s…
1.3k · recognition
compartespeech-synthesisspeech-recognition
Ming-UniAudio
Ming-UniAudio: LLM de Voz para Comprensión, Generación y Edición Conjunta con Representación Un…
450 · speech
compartespeech-synthesisspeech-recognition
Freeze-Omni
✨✨Freeze-Omni: Un Modelo de Diálogo de Voz-a-Voz Inteligente y de Baja Latencia con LLM Congela…
395 · large-language-models
compartespeech-synthesisspeech-recognition
kaldi-gstreamer-server
Servidor de reconocimiento de voz en tiempo real y dúplex completo, basado en el kit de herrami…
1.1k · speech-recognition
compartespeech-recognition
FastASR
Este es un proyecto de inferencia ASR implementado en C++, que tiene pocas dependencias, es fác…
553 · speech-recognition
compartespeech-recognition
dragonfly
Marco de reconocimiento de voz que permite una potente programación y extensión basada en Pytho…
413 · python
compartespeech-recognition

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.