Startseite Projekte Make-An-Audio
Make-An-Audio

Make-An-Audio

von Text-to-Audio · GitHub

PyTorch-Implementierung von Make-An-Audio (ICML'23) mit einem Text-zu-Audio-generativen Modell

Auf GitHub ansehen
In einfachen Worten

Generieren Sie hochwertige Audiodateien aus Text mithilfe eines maschinellen Lernmodells, mit verfügbaren Beispielen zum Ausprobieren.

⭐ Sterne
🍴 Forks
📜 Lizenz
Kommerzielle Nutzung erlaubt
📅 Erstellt
🔄 Letzter Commit
🏷️ Kategorie
💻 Sprache
Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
Make-An-Audio — GitHub preview card
📈 Sternhistorie
670669
2026-07-202026-07-29
📈 Make-An-Audio verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

PyTorch-Implementierung von Make-An-Audio (ICML'23) mit einem Text-zu-Audio-generativen Modell

Make-An-Audio hat 669 Sterne auf GitHub. Es wurde 92-mal geforkt. Make-An-Audio ist hauptsächlich in Python geschrieben. Es wird seit 2023 aktiv entwickelt. Make-An-Audio ist unter der MIT-Lizenz verfügbar. Die Hauptthemen sind: diffusion-models, latent-diffusion, latent-space, text-to-audio.

Frequently asked questions

Was ist Make-An-Audio?

PyTorch-Implementierung von Make-An-Audio (ICML'23) mit einem Text-zu-Audio-generativen Modell

Ist Make-An-Audio Open Source?

Make-An-Audio ist ein Open-Source-Projekt. Es wird unter der MIT-Lizenz veröffentlicht.

Ist Make-An-Audio kostenlos?

Ja. Make-An-Audio ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

Unter welcher Lizenz steht Make-An-Audio?

Make-An-Audio ist unter der MIT-Lizenz verfügbar.

In welcher Sprache ist Make-An-Audio geschrieben?

Make-An-Audio ist hauptsächlich in Python geschrieben.

🏅 Wartender dieses Projekts?
OpenSourceAI badge — Make-An-Audio

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=text-to-audio-make-an-audio)](https://opensourceai.tech/project/text-to-audio-make-an-audio.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →
AudioStory
AudioStory: Generierung von Langform-Narrativ-Audio mit großen Sprachmodellen
301 · audio-generation
teiltvideo-to-audiotext-to-audio
MMAudio
[CVPR 2025] MMAudio: Zähmung multimodaler gemeinsamer Trainings für hochwertige Video-zu-Audio-…
2.2k · audio
teiltvideo-to-audiotext-to-audio
EzAudio
Hochwertige Text-zu-Audio-Generierung mit effizientem Diffusions-Transformer
333 · diffusion-models
teilttext-to-audiodiffusion-models
mustango
Mustango: Auf dem Weg zur kontrollierbaren Text-zu-Musik-Generierung
394 · diffusion-models
teilttext-to-audiodiffusion-models
audio-diffusion
Wenden Sie Diffusionsmodelle mit dem neuen Hugging Face Diffusers-Paket an, um Musik anstelle v…
792 · diffusion-models
teiltlatent-diffusiondiffusion-models
FoleyCrafter
[IJCV 2026] FoleyCrafter: Bringen Sie stille Videos mit lebensechten und synchronisierten Kläng…
658 · aigc
teiltvideo-to-audiodiffusion-models
LFM
Offizielle PyTorch-Implementierung des Papiers: Flow Matching in Latent Space
357 · conditional-normalizing-flows
teiltlatent-spacediffusion-models
tango
Eine Familie von Diffusionsmodellen zur Text-zu-Audio-Generierung.
1.2k · audio-generation
teilttext-to-audiodiffusion-models
One-DM
Offizieller Code für das ECCV 2024-Papier — One-Shot Diffusion Mimicker für die Generierung han…
559 · computer-vision
teiltlatent-diffusiondiffusion-models
DiffusionFastForward
DiffusionFastForward: ein kostenloser Kurs und experimenteller Rahmen für diffusionsbasierte ge…
682 · diffusion-model
teiltlatent-diffusiondiffusion-models

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.