Startseite Projekte AudioStory
AudioStory
Jupyter Notebook

AudioStory

AudioStory: Generierung von Langform-Narrativ-Audio mit großen Sprachmodellen

von TencentARC · GitHub
Sterne
Forks
Erstellt
Letzter Commit
audio-generationdiffusion-modelsmultimodal-large-language-modelsJupyter Notebook
Auf GitHub ansehen
In einfachen Worten

Generieren Sie lange Audio-Geschichten aus Text oder synchronisieren Sie Videos mit Audio mithilfe eines einfachen Modells.

Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
AudioStory — GitHub preview card
📈 Sternhistorie
302301
2026-07-202026-08-14
📈 AudioStory verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

AudioStory: Generierung von Langform-Narrativ-Audio mit großen Sprachmodellen

AudioStory hat 301 Sterne auf GitHub. Es wurde 22-mal geforkt. AudioStory ist hauptsächlich in Jupyter Notebook geschrieben. Es wird seit 2025 aktiv entwickelt. Die Hauptthemen sind: audio-generation, diffusion-models, multimodal-large-language-models, text-to-audio.

Frequently asked questions

Was ist AudioStory?

AudioStory: Generierung von Langform-Narrativ-Audio mit großen Sprachmodellen

Ist AudioStory Open Source?

AudioStory ist ein Open-Source-Projekt.

Ist AudioStory kostenlos?

Ja. AudioStory ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

In welcher Sprache ist AudioStory geschrieben?

AudioStory ist hauptsächlich in Jupyter Notebook geschrieben.

🏅 Wartender dieses Projekts?
olud.ai badge — AudioStory

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![olud.ai](https://olud.ai/badge.php?tool=tencentarc-audiostory)](https://olud.ai/project/tencentarc-audiostory.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →
tango
Eine Familie von Diffusionsmodellen zur Text-zu-Audio-Generierung.
1.2k · audio-generation
teilttext-to-audioaudio-generation
EzAudio
Hochwertige Text-zu-Audio-Generierung mit effizientem Diffusions-Transformer
333 · diffusion-models
teilttext-to-audiodiffusion-models
mustango
Mustango: Auf dem Weg zur kontrollierbaren Text-zu-Musik-Generierung
394 · diffusion-models
teilttext-to-audiodiffusion-models
Make-An-Audio
PyTorch-Implementierung von Make-An-Audio (ICML'23) mit einem Text-zu-Audio-generativen Modell
669 · diffusion-models
teilttext-to-audiodiffusion-models
MM-Diffusion
[CVPR'23] MM-Diffusion: Lernen von multimodalen Diffusionsmodellen für die gemeinsame Audio- un…
453 · audio-generation
teiltaudio-generationdiffusion-models
audio-ai-timeline
Eine Zeitleiste der neuesten KI-Modelle für Audio-Generierung, beginnend im Jahr 2023!
1.9k · artificial-intelligence
teiltaudio-generation
nuwa-pytorch
Implementierung von NÜWA, einem hochmodernen Aufmerksamkeitsnetzwerk für die Synthese von Text…
548 · artificial-intelligence
teilttext-to-audio
YuE
YuE: Open Full-Song Musikgenerierungsgrundmodell, etwas ähnlich wie Suno.ai, aber offen.
6.3k · ai
teiltaudio-generation
soundstorm-pytorch
Implementierung von SoundStorm, effizienter paralleler Audio-Generierung von Google Deepmind, i…
1.5k · artificial-intelligence
teiltaudio-generation
Awesome-Medical-Large-Language-Models
Kuratiertes Papier zu großen Sprachmodellen im Gesundheitswesen und medizinischen Bereich
393 · large-language-models
teiltmultimodal-large-language-models

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.