Home Progetti Make-An-Audio
Make-An-Audio

Make-An-Audio

di Text-to-Audio · GitHub

Implementazione PyTorch di Make-An-Audio (ICML'23) con un modello generativo da testo a audio

Visualizza su GitHub
In parole semplici

Genera audio di alta qualità da testo utilizzando un modello di machine learning, con esempi disponibili da provare.

⭐ Stelle
🍴 Fork
📜 Licenza
Uso commerciale consentito
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
Make-An-Audio — GitHub preview card
📈 Storia delle stelle
670669
2026-07-202026-07-29
📈 Segui Make-An-Audio

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Implementazione PyTorch di Make-An-Audio (ICML'23) con un modello generativo da testo a audio

Make-An-Audio ha 669 stelle su GitHub. È stato forkato 92 volte. Make-An-Audio è scritto principalmente in Python. È in sviluppo attivo dal 2023. Make-An-Audio è disponibile con licenza MIT. I suoi temi principali sono: diffusion-models, latent-diffusion, latent-space, text-to-audio.

Frequently asked questions

Che cos'è Make-An-Audio?

Implementazione PyTorch di Make-An-Audio (ICML'23) con un modello generativo da testo a audio

Make-An-Audio è open source?

Make-An-Audio è un progetto open source. È rilasciato con licenza MIT.

Make-An-Audio è gratuito?

Sì. Make-An-Audio è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è Make-An-Audio?

Make-An-Audio è disponibile con licenza MIT.

In quale linguaggio è scritto Make-An-Audio?

Make-An-Audio è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
OpenSourceAI badge — Make-An-Audio

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=text-to-audio-make-an-audio)](https://opensourceai.tech/project/text-to-audio-make-an-audio.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
AudioStory
AudioStory: Generazione di audio narrativo lungo con modelli di linguaggio di grandi dimensioni
301 · audio-generation
condividevideo-to-audiotext-to-audio
MMAudio
[CVPR 2025] MMAudio: Domare l'Addestramento Congiunto Multimodale per la Sintesi Video-a-Audio…
2.2k · audio
condividevideo-to-audiotext-to-audio
EzAudio
Generazione di Testo in Audio di Alta Qualità con Trasformatore di Diffusione Efficiente
333 · diffusion-models
condividetext-to-audiodiffusion-models
mustango
Mustango: Verso la generazione controllabile di testo in musica
394 · diffusion-models
condividetext-to-audiodiffusion-models
audio-diffusion
Applica modelli di diffusione utilizzando il nuovo pacchetto diffusers di Hugging Face per sint…
792 · diffusion-models
condividelatent-diffusiondiffusion-models
FoleyCrafter
[IJCV 2026] FoleyCrafter: Porta i video silenziosi in vita con suoni realistici e sincronizzati…
658 · aigc
condividevideo-to-audiodiffusion-models
LFM
Implementazione ufficiale in PyTorch dell'articolo: Flow Matching in Latent Space
357 · conditional-normalizing-flows
condividelatent-spacediffusion-models
tango
Una famiglia di modelli di diffusione per la generazione di testo in audio.
1.2k · audio-generation
condividetext-to-audiodiffusion-models
One-DM
Codice ufficiale per l'articolo ECCV 2024 — Mimicker di Diffusione One-Shot per la Generazione…
559 · computer-vision
condividelatent-diffusiondiffusion-models
DiffusionFastForward
DiffusionFastForward: un corso gratuito e un framework sperimentale per modelli generativi basa…
682 · diffusion-model
condividelatent-diffusiondiffusion-models

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.