Home Progetti EzAudio
EzAudio
Python

EzAudio

Generazione di Testo in Audio di Alta Qualità con Trasformatore di Diffusione Efficiente

di haidog-yaqub · GitHub
Stelle
Fork
Licenza
Creato
Ultimo commit
Lingua
diffusion-modelsgenerative-aitext-to-audioMITPython
Visualizza su GitHub
In parole semplici

Genera audio di alta qualità da testo utilizzando un modello basato su diffusione con minori esigenze computazionali.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
EzAudio — GitHub preview card
📈 Storia delle stelle
333332
2026-07-202026-08-31
📈 Segui EzAudio

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Generazione di Testo in Audio di Alta Qualità con Trasformatore di Diffusione Efficiente

EzAudio ha 332 stelle su GitHub. È stato forkato 25 volte. EzAudio è scritto principalmente in Python. È in sviluppo attivo dal 2024. EzAudio è disponibile con licenza MIT. I suoi temi principali sono: diffusion-models, generative-ai, text-to-audio.

Frequently asked questions

Che cos'è EzAudio?

Generazione di Testo in Audio di Alta Qualità con Trasformatore di Diffusione Efficiente

EzAudio è open source?

EzAudio è un progetto open source. È rilasciato con licenza MIT.

EzAudio è gratuito?

Sì. EzAudio è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è EzAudio?

EzAudio è disponibile con licenza MIT.

In quale linguaggio è scritto EzAudio?

EzAudio è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — EzAudio

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=haidog-yaqub-ezaudio)](https://olud.ai/project/haidog-yaqub-ezaudio.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
mustango
Mustango: Verso la generazione controllabile di testo in musica
395 · diffusion-models
condividetext-to-audiodiffusion-models
AudioStory
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
301 · audio-generation
condividetext-to-audiodiffusion-models
Make-An-Audio
Implementazione PyTorch di Make-An-Audio (ICML'23) con un modello generativo da testo a audio
669 · diffusion-models
condividetext-to-audiodiffusion-models
tango
Una famiglia di modelli di diffusione per la generazione di testo in audio.
1.2k · audio-generation
condividetext-to-audiodiffusion-models
nuwa-pytorch
Implementazione di NÜWA, rete di attenzione all'avanguardia per la sintesi video da testo, in P…
548 · artificial-intelligence
condividetext-to-audio
Open-dLLM
Modello di linguaggio di diffusione aperto per la generazione di codice — rilascio di pre-addes…
649 · diffusion-models
condividediffusion-models
MimicMotion
Generazione di video di movimento umano di alta qualità con guida alla posa consapevole della f…
2.6k · diffusion-models
condividediffusion-models
PVDM
[CVPR'23] Modelli di Diffusione Probabilistica Video nello Spazio Latente Proiettato
322 · diffusion-models
condividediffusion-models
REPA
[ICLR'25 Oral] Allineamento della rappresentazione per la generazione: Addestrare i trasformato…
1.7k · diffusion
condividediffusion-models
Paella
Implementazione ufficiale di Paella https://arxiv.org/abs/2211.07292v2
748 · diffusion-models
condividediffusion-models

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.