Inicio Proyectos EzAudio
EzAudio
Python

EzAudio

Generación de Texto a Audio de Alta Calidad con Transformador de Difusión Eficiente

por haidog-yaqub · GitHub
Estrellas
Ramas
Licencia
Creado
Último commit
Lenguaje
diffusion-modelsgenerative-aitext-to-audioMITPython
Ver en GitHub
En palabras simples

Genera audio de alta calidad a partir de texto utilizando un modelo basado en difusión con menores necesidades computacionales.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
EzAudio — GitHub preview card
📈 Historial de estrellas
333332
2026-07-202026-08-31
📈 Sigue EzAudio

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Generación de Texto a Audio de Alta Calidad con Transformador de Difusión Eficiente

EzAudio tiene 332 estrellas en GitHub. Se ha bifurcado 25 veces. EzAudio está escrito principalmente en Python. Se desarrolla activamente desde 2024. EzAudio está disponible bajo la licencia MIT. Sus temas principales son: diffusion-models, generative-ai, text-to-audio.

Frequently asked questions

¿Qué es EzAudio?

Generación de Texto a Audio de Alta Calidad con Transformador de Difusión Eficiente

¿EzAudio es de código abierto?

EzAudio es un proyecto de código abierto. Se distribuye bajo la licencia MIT.

¿EzAudio es gratis?

Sí. EzAudio es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está EzAudio?

EzAudio está disponible bajo la licencia MIT.

¿En qué lenguaje está escrito EzAudio?

EzAudio está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — EzAudio

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=haidog-yaqub-ezaudio)](https://olud.ai/project/haidog-yaqub-ezaudio.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
mustango
Mustango: Hacia la generación controlable de texto a música
395 · diffusion-models
compartetext-to-audiodiffusion-models
AudioStory
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
301 · audio-generation
compartetext-to-audiodiffusion-models
Make-An-Audio
Implementación en PyTorch de Make-An-Audio (ICML'23) con un modelo generativo de texto a audio
669 · diffusion-models
compartetext-to-audiodiffusion-models
tango
Una familia de modelos de difusión para generación de texto a audio.
1.2k · audio-generation
compartetext-to-audiodiffusion-models
nuwa-pytorch
Implementación de NÜWA, red de atención de última generación para síntesis de texto a video, en…
548 · artificial-intelligence
compartetext-to-audio
Open-dLLM
Modelo de lenguaje de difusión abierta para generación de código — liberando preentrenamiento,…
649 · diffusion-models
compartediffusion-models
MimicMotion
Generación de Video de Movimiento Humano de Alta Calidad con Guía de Pose Consciente de Confian…
2.6k · diffusion-models
compartediffusion-models
PVDM
[CVPR'23] Modelos de Difusión Probabilística de Video en Espacio Latente Proyectado
322 · diffusion-models
compartediffusion-models
REPA
[ICLR'25 Oral] Alineación de Representación para Generación: Entrenar Transformadores de Difusi…
1.7k · diffusion
compartediffusion-models
Paella
Implementación oficial de Paella https://arxiv.org/abs/2211.07292v2
748 · diffusion-models
compartediffusion-models

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.