Home Progetti EzAudio
EzAudio

EzAudio

di haidog-yaqub · GitHub

Generazione di Testo in Audio di Alta Qualità con Trasformatore di Diffusione Efficiente

Visualizza su GitHub
⭐ Stelle
🍴 Fork
📜 Licenza
Uso commerciale consentito
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
EzAudio — GitHub preview card
📈 Storia delle stelle
334333
2026-07-202026-07-29
📈 Segui EzAudio

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Generazione di Testo in Audio di Alta Qualità con Trasformatore di Diffusione Efficiente

EzAudio ha 333 stelle su GitHub. È stato forkato 25 volte. EzAudio è scritto principalmente in Python. È in sviluppo attivo dal 2024. EzAudio è disponibile con licenza MIT. I suoi temi principali sono: diffusion-models, generative-ai, text-to-audio.

Frequently asked questions

Che cos'è EzAudio?

Generazione di Testo in Audio di Alta Qualità con Trasformatore di Diffusione Efficiente

EzAudio è open source?

EzAudio è un progetto open source. È rilasciato con licenza MIT.

EzAudio è gratuito?

Sì. EzAudio è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è EzAudio?

EzAudio è disponibile con licenza MIT.

In quale linguaggio è scritto EzAudio?

EzAudio è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
OpenSourceAI badge — EzAudio

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=haidog-yaqub-ezaudio)](https://opensourceai.tech/project/haidog-yaqub-ezaudio.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
mustango
Mustango: Verso la generazione controllabile di testo in musica
394 · diffusion-models
condividetext-to-audiodiffusion-models
tango
Una famiglia di modelli di diffusione per la generazione di testo in audio.
1.2k · audio-generation
condividetext-to-audiodiffusion-models
Make-An-Audio
Implementazione PyTorch di Make-An-Audio (ICML'23) con un modello generativo da testo a audio
669 · diffusion-models
condividetext-to-audiodiffusion-models
AudioStory
AudioStory: Generazione di audio narrativo lungo con modelli di linguaggio di grandi dimensioni
301 · audio-generation
condividetext-to-audiodiffusion-models
Open-dLLM
Modello di linguaggio di diffusione aperto per la generazione di codice — rilascio di pre-addes…
643 · diffusion-models
condividediffusion-models
nuwa-pytorch
Implementazione di NÜWA, rete di attenzione all'avanguardia per la sintesi video da testo, in P…
548 · artificial-intelligence
condividetext-to-audio
MimicMotion
Generazione di video di movimento umano di alta qualità con guida alla posa consapevole della f…
2.6k · diffusion-models
condividediffusion-models
PVDM
[CVPR'23] Modelli di Diffusione Probabilistica Video nello Spazio Latente Proiettato
322 · diffusion-models
condividediffusion-models
Awesome-diffusion-model-for-image-processing
un riepilogo dell'elaborazione delle immagini basata sulla diffusione, inclusi ripristino, migl…
954 · diffusion-models
condividediffusion-models
REPA
[ICLR'25 Oral] Allineamento della rappresentazione per la generazione: Addestrare i trasformato…
1.7k · diffusion
condividediffusion-models

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.