Inicio Proyectos Ming-UniAudio
Ming-UniAudio
Python

Ming-UniAudio

Ming-UniAudio: LLM de Voz para Comprensión, Generación y Edición Conjunta con Representación Unificada

por inclusionAI · GitHub
Estrellas
Ramas
Licencia
Creado
Último commit
Categoría
Lenguaje
speechspeech-recognitionspeech-synthesisMITPython
Ver en GitHub
En palabras simples

Utiliza un marco para entender, generar y editar el habla en un modelo unificado.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
Ming-UniAudio — GitHub preview card
📈 Historial de estrellas
451450
2026-07-202026-08-31
📈 Sigue Ming-UniAudio

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Ming-UniAudio: LLM de Voz para Comprensión, Generación y Edición Conjunta con Representación Unificada

Ming-UniAudio tiene 450 estrellas en GitHub. Se ha bifurcado 30 veces. Ming-UniAudio está escrito principalmente en Python. Se desarrolla activamente desde 2025. Ming-UniAudio está disponible bajo la licencia MIT. Sus temas principales son: speech, speech-recognition, speech-synthesis, unified-model.

Frequently asked questions

¿Qué es Ming-UniAudio?

Ming-UniAudio: LLM de Voz para Comprensión, Generación y Edición Conjunta con Representación Unificada

¿Ming-UniAudio es de código abierto?

Ming-UniAudio es un proyecto de código abierto. Se distribuye bajo la licencia MIT.

¿Ming-UniAudio es gratis?

Sí. Ming-UniAudio es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está Ming-UniAudio?

Ming-UniAudio está disponible bajo la licencia MIT.

¿En qué lenguaje está escrito Ming-UniAudio?

Ming-UniAudio está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — Ming-UniAudio

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=inclusionai-ming-uniaudio)](https://olud.ai/project/inclusionai-ming-uniaudio.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
speech-recognition-uk
🇺🇦 Reconocimiento y Síntesis de Voz para Ucraniano
439 · speech
compartespeechspeech-synthesis
Freeze-Omni
✨✨Freeze-Omni: Un Modelo de Diálogo de Voz-a-Voz Inteligente y de Baja Latencia con LLM Congela…
395 · large-language-models
compartespeechspeech-synthesis
vits2
VITS2: Mejora de la Calidad y Eficiencia del Texto a Voz de Etapa Única con Aprendizaje Adversa…
642 · deep-learning
compartespeechspeech-synthesis
local-talking-llm
Un LLM hablante que se ejecuta en tu propia computadora sin necesidad de internet.
878 · chatbot
compartespeech-synthesisspeech-recognition
Speech-Backbones
Este es el repositorio principal de tecnología de voz de código abierto por el Laboratorio Noah…
604 · speech-processing
compartespeech-synthesisspeech-recognition
Irene-Voice-Assistant
Ирина - русский голосовой ассистент для работы оффлайн. Поддерживает скиллы через плагины.
1.1k · python
compartespeech-synthesisspeech-recognition
whisperX
WhisperX: Reconocimiento Automático de Voz con Tiempos de Palabras (& Diarización)
23.1k · asr
compartespeechspeech-recognition
MARS5-TTS
Modelo de voz MARS5 (TTS) de CAMB.AI
2.8k · prosody
compartespeechspeech-synthesis
MsEdgeTTS
Un módulo simple del Servicio de Voz de Azure que utiliza la API de Microsoft Edge Leer en Voz…
335 · free-tts
compartespeechspeech-synthesis
stt
Herramienta de reconocimiento de voz a texto / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式
4.7k · speech
compartespeechspeech-recognition

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.