Startseite Projekte EzAudio
EzAudio

EzAudio

von haidog-yaqub · GitHub

Hochwertige Text-zu-Audio-Generierung mit effizientem Diffusions-Transformer

Auf GitHub ansehen
⭐ Sterne
🍴 Forks
📜 Lizenz
Kommerzielle Nutzung erlaubt
📅 Erstellt
🔄 Letzter Commit
🏷️ Kategorie
💻 Sprache
Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
EzAudio — GitHub preview card
📈 Sternhistorie
334333
2026-07-202026-07-29
📈 EzAudio verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

Hochwertige Text-zu-Audio-Generierung mit effizientem Diffusions-Transformer

EzAudio hat 333 Sterne auf GitHub. Es wurde 25-mal geforkt. EzAudio ist hauptsächlich in Python geschrieben. Es wird seit 2024 aktiv entwickelt. EzAudio ist unter der MIT-Lizenz verfügbar. Die Hauptthemen sind: diffusion-models, generative-ai, text-to-audio.

Frequently asked questions

Was ist EzAudio?

Hochwertige Text-zu-Audio-Generierung mit effizientem Diffusions-Transformer

Ist EzAudio Open Source?

EzAudio ist ein Open-Source-Projekt. Es wird unter der MIT-Lizenz veröffentlicht.

Ist EzAudio kostenlos?

Ja. EzAudio ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

Unter welcher Lizenz steht EzAudio?

EzAudio ist unter der MIT-Lizenz verfügbar.

In welcher Sprache ist EzAudio geschrieben?

EzAudio ist hauptsächlich in Python geschrieben.

🏅 Wartender dieses Projekts?
OpenSourceAI badge — EzAudio

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=haidog-yaqub-ezaudio)](https://opensourceai.tech/project/haidog-yaqub-ezaudio.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →
mustango
Mustango: Auf dem Weg zur kontrollierbaren Text-zu-Musik-Generierung
394 · diffusion-models
teilttext-to-audiodiffusion-models
tango
Eine Familie von Diffusionsmodellen zur Text-zu-Audio-Generierung.
1.2k · audio-generation
teilttext-to-audiodiffusion-models
Make-An-Audio
PyTorch-Implementierung von Make-An-Audio (ICML'23) mit einem Text-zu-Audio-generativen Modell
669 · diffusion-models
teilttext-to-audiodiffusion-models
AudioStory
AudioStory: Generierung von Langform-Narrativ-Audio mit großen Sprachmodellen
301 · audio-generation
teilttext-to-audiodiffusion-models
Open-dLLM
Open-Diffusions-Sprachmodell zur Codegenerierung — Veröffentlichung von Vortraining, Bewertung,…
643 · diffusion-models
teiltdiffusion-models
nuwa-pytorch
Implementierung von NÜWA, einem hochmodernen Aufmerksamkeitsnetzwerk für die Synthese von Text…
548 · artificial-intelligence
teilttext-to-audio
MimicMotion
Hochwertige menschliche Bewegungs-Videogenerierung mit kontextbewusster Pose-Anleitung
2.6k · diffusion-models
teiltdiffusion-models
PVDM
[CVPR'23] Video-Probabilistische Diffusionsmodelle im projizierten latenten Raum
322 · diffusion-models
teiltdiffusion-models
Awesome-diffusion-model-for-image-processing
eine Zusammenfassung der bildverarbeitenden Diffusionsmethoden, einschließlich Wiederherstellun…
954 · diffusion-models
teiltdiffusion-models
REPA
[ICLR'25 Oral] Repräsentationsausrichtung für die Generierung: Training von Diffusions-Transfor…
1.7k · diffusion
teiltdiffusion-models

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.