Home Progetti AudioStory
AudioStory
Jupyter Notebook

AudioStory

AudioStory: Generazione di audio narrativo lungo con modelli di linguaggio di grandi dimensioni

di TencentARC · GitHub
Stelle
Fork
Creato
Ultimo commit
audio-generationdiffusion-modelsmultimodal-large-language-modelsJupyter Notebook
Visualizza su GitHub
In parole semplici

Genera lunghe storie audio da testo, o doppia video con audio utilizzando un modello semplice.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
AudioStory — GitHub preview card
📈 Storia delle stelle
302301
2026-07-202026-08-14
📈 Segui AudioStory

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

AudioStory: Generazione di audio narrativo lungo con modelli di linguaggio di grandi dimensioni

AudioStory ha 301 stelle su GitHub. È stato forkato 22 volte. AudioStory è scritto principalmente in Jupyter Notebook. È in sviluppo attivo dal 2025. I suoi temi principali sono: audio-generation, diffusion-models, multimodal-large-language-models, text-to-audio.

Frequently asked questions

Che cos'è AudioStory?

AudioStory: Generazione di audio narrativo lungo con modelli di linguaggio di grandi dimensioni

AudioStory è open source?

AudioStory è un progetto open source.

AudioStory è gratuito?

Sì. AudioStory è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

In quale linguaggio è scritto AudioStory?

AudioStory è scritto principalmente in Jupyter Notebook.

🏅 Manutentore di questo progetto?
olud.ai badge — AudioStory

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=tencentarc-audiostory)](https://olud.ai/project/tencentarc-audiostory.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
tango
Una famiglia di modelli di diffusione per la generazione di testo in audio.
1.2k · audio-generation
condividetext-to-audioaudio-generation
EzAudio
Generazione di Testo in Audio di Alta Qualità con Trasformatore di Diffusione Efficiente
333 · diffusion-models
condividetext-to-audiodiffusion-models
mustango
Mustango: Verso la generazione controllabile di testo in musica
394 · diffusion-models
condividetext-to-audiodiffusion-models
Make-An-Audio
Implementazione PyTorch di Make-An-Audio (ICML'23) con un modello generativo da testo a audio
669 · diffusion-models
condividetext-to-audiodiffusion-models
MM-Diffusion
[CVPR'23] MM-Diffusion: Apprendimento di modelli di diffusione multimodali per la generazione c…
453 · audio-generation
condivideaudio-generationdiffusion-models
audio-ai-timeline
Una cronologia dei modelli AI più recenti per la generazione audio, a partire dal 2023!
1.9k · artificial-intelligence
condivideaudio-generation
nuwa-pytorch
Implementazione di NÜWA, rete di attenzione all'avanguardia per la sintesi video da testo, in P…
548 · artificial-intelligence
condividetext-to-audio
YuE
YuE: Modello di generazione musicale open full-song, qualcosa di simile a Suno.ai ma open
6.3k · ai
condivideaudio-generation
soundstorm-pytorch
Implementazione di SoundStorm, generazione audio parallela efficiente da Google Deepmind, in Py…
1.5k · artificial-intelligence
condivideaudio-generation
Awesome-Medical-Large-Language-Models
Articoli curati sui modelli di linguaggio di grandi dimensioni nel settore sanitario e medico
393 · large-language-models
condividemultimodal-large-language-models

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.