Home Progetti AudioStory
AudioStory

AudioStory

di TencentARC · GitHub

AudioStory: Generazione di audio narrativo lungo con modelli di linguaggio di grandi dimensioni

Visualizza su GitHub
⭐ Stelle
🍴 Fork
📜 Licenza
Licenza non specificata
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
AudioStory — GitHub preview card
📈 Storia delle stelle
302301
2026-07-202026-07-29
📈 Segui AudioStory

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

AudioStory: Generazione di audio narrativo lungo con modelli di linguaggio di grandi dimensioni

AudioStory ha 301 stelle su GitHub. È stato forkato 22 volte. AudioStory è scritto principalmente in Jupyter Notebook. È in sviluppo attivo dal 2025. I suoi temi principali sono: audio-generation, diffusion-models, multimodal-large-language-models, text-to-audio.

Frequently asked questions

Che cos'è AudioStory?

AudioStory: Generazione di audio narrativo lungo con modelli di linguaggio di grandi dimensioni

AudioStory è open source?

AudioStory è un progetto open source.

AudioStory è gratuito?

Sì. AudioStory è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

In quale linguaggio è scritto AudioStory?

AudioStory è scritto principalmente in Jupyter Notebook.

🏅 Manutentore di questo progetto?
OpenSourceAI badge — AudioStory

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=tencentarc-audiostory)](https://opensourceai.tech/project/tencentarc-audiostory.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
Make-An-Audio
Implementazione PyTorch di Make-An-Audio (ICML'23) con un modello generativo da testo a audio
669 · diffusion-models
condividevideo-to-audiotext-to-audio
tango
Una famiglia di modelli di diffusione per la generazione di testo in audio.
1.2k · audio-generation
condividetext-to-audioaudio-generation
MMAudio
[CVPR 2025] MMAudio: Domare l'Addestramento Congiunto Multimodale per la Sintesi Video-a-Audio…
2.2k · audio
condividevideo-to-audiotext-to-audio
EzAudio
Generazione di Testo in Audio di Alta Qualità con Trasformatore di Diffusione Efficiente
333 · diffusion-models
condividetext-to-audiodiffusion-models
mustango
Mustango: Verso la generazione controllabile di testo in musica
394 · diffusion-models
condividetext-to-audiodiffusion-models
FoleyCrafter
[IJCV 2026] FoleyCrafter: Porta i video silenziosi in vita con suoni realistici e sincronizzati…
658 · aigc
condividevideo-to-audiodiffusion-models
MM-Diffusion
[CVPR'23] MM-Diffusion: Apprendimento di modelli di diffusione multimodali per la generazione c…
453 · audio-generation
condivideaudio-generationdiffusion-models
LocalAI
LocalAI è il motore AI open-source. Esegui qualsiasi modello - LLM, visione, voce, immagine, vi…
48k · agents
CosyVoice
Modello di generazione vocale multilingue di grandi dimensioni, che fornisce capacità complete…
22.5k · audio-generation
Amphion
Amphion (/æmˈfaɪən/) è un toolkit per la generazione di audio, musica e discorsi. Il suo scopo…
10k · audio-generation

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.