Inicio Proyectos EzAudio
EzAudio

EzAudio

por haidog-yaqub · GitHub

Generación de Texto a Audio de Alta Calidad con Transformador de Difusión Eficiente

Ver en GitHub
⭐ Estrellas
🍴 Ramas
📜 Licencia
Uso comercial permitido
📅 Creado
🔄 Último commit
🏷️ Categoría
💻 Lenguaje
¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
EzAudio — GitHub preview card
📈 Historial de estrellas
334333
2026-07-202026-07-29
📈 Sigue EzAudio

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Generación de Texto a Audio de Alta Calidad con Transformador de Difusión Eficiente

EzAudio tiene 333 estrellas en GitHub. Se ha bifurcado 25 veces. EzAudio está escrito principalmente en Python. Se desarrolla activamente desde 2024. EzAudio está disponible bajo la licencia MIT. Sus temas principales son: diffusion-models, generative-ai, text-to-audio.

Frequently asked questions

¿Qué es EzAudio?

Generación de Texto a Audio de Alta Calidad con Transformador de Difusión Eficiente

¿EzAudio es de código abierto?

EzAudio es un proyecto de código abierto. Se distribuye bajo la licencia MIT.

¿EzAudio es gratis?

Sí. EzAudio es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está EzAudio?

EzAudio está disponible bajo la licencia MIT.

¿En qué lenguaje está escrito EzAudio?

EzAudio está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
OpenSourceAI badge — EzAudio

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=haidog-yaqub-ezaudio)](https://opensourceai.tech/project/haidog-yaqub-ezaudio.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
mustango
Mustango: Hacia la generación controlable de texto a música
394 · diffusion-models
compartetext-to-audiodiffusion-models
tango
Una familia de modelos de difusión para generación de texto a audio.
1.2k · audio-generation
compartetext-to-audiodiffusion-models
Make-An-Audio
Implementación en PyTorch de Make-An-Audio (ICML'23) con un modelo generativo de texto a audio
669 · diffusion-models
compartetext-to-audiodiffusion-models
AudioStory
AudioStory: Generando audio narrativo de larga duración con grandes modelos de lenguaje
301 · audio-generation
compartetext-to-audiodiffusion-models
Open-dLLM
Modelo de lenguaje de difusión abierta para generación de código — liberando preentrenamiento,…
643 · diffusion-models
compartediffusion-models
nuwa-pytorch
Implementación de NÜWA, red de atención de última generación para síntesis de texto a video, en…
548 · artificial-intelligence
compartetext-to-audio
MimicMotion
Generación de Video de Movimiento Humano de Alta Calidad con Guía de Pose Consciente de Confian…
2.6k · diffusion-models
compartediffusion-models
PVDM
[CVPR'23] Modelos de Difusión Probabilística de Video en Espacio Latente Proyectado
322 · diffusion-models
compartediffusion-models
Awesome-diffusion-model-for-image-processing
un resumen del procesamiento de imágenes basado en difusión, incluyendo restauración, mejora, c…
954 · diffusion-models
compartediffusion-models
REPA
[ICLR'25 Oral] Alineación de Representación para Generación: Entrenar Transformadores de Difusi…
1.7k · diffusion
compartediffusion-models

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.