Accueil Projets AudioStory
AudioStory
Jupyter Notebook

AudioStory

AudioStory : Génération d'audio narratif long avec de grands modèles de langage

par TencentARC · GitHub
Étoiles
Forks
Créé
Dernier commit
audio-generationdiffusion-modelsmultimodal-large-language-modelsJupyter Notebook
Voir sur GitHub
En termes simples

Générez de longues histoires audio à partir de texte, ou doublez des vidéos avec de l'audio en utilisant un modèle simple.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
AudioStory — GitHub preview card
📈 Historique des étoiles
302301
2026-07-202026-08-14
📈 Suivez AudioStory

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

AudioStory : Génération d'audio narratif long avec de grands modèles de langage

AudioStory compte 301 étoiles sur GitHub. Il a été forké 22 fois. AudioStory est écrit principalement en Jupyter Notebook. Il est développé activement depuis 2025. Ses principaux thèmes sont : audio-generation, diffusion-models, multimodal-large-language-models, text-to-audio.

Frequently asked questions

Qu'est-ce que AudioStory ?

AudioStory : Génération d'audio narratif long avec de grands modèles de langage

AudioStory est-il open source ?

AudioStory est un projet open source.

AudioStory est-il gratuit ?

Oui. AudioStory est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Dans quel langage AudioStory est-il écrit ?

AudioStory est écrit principalement en Jupyter Notebook.

🏅 Mainteneur de ce projet ?
olud.ai badge — AudioStory

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=tencentarc-audiostory)](https://olud.ai/project/tencentarc-audiostory.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
tango
Une famille de modèles de diffusion pour la génération de texte à audio.
1.2k · audio-generation
partagetext-to-audioaudio-generation
EzAudio
Génération de texte en audio de haute qualité avec Efficient Diffusion Transformer
333 · diffusion-models
partagetext-to-audiodiffusion-models
mustango
Mustango : Vers une génération de musique contrôlable à partir de texte
394 · diffusion-models
partagetext-to-audiodiffusion-models
Make-An-Audio
Implémentation PyTorch de Make-An-Audio (ICML'23) avec un modèle génératif texte-à-audio
669 · diffusion-models
partagetext-to-audiodiffusion-models
MM-Diffusion
[CVPR'23] MM-Diffusion : Apprentissage de modèles de diffusion multimodaux pour la génération c…
453 · audio-generation
partageaudio-generationdiffusion-models
audio-ai-timeline
Une chronologie des derniers modèles d'IA pour la génération audio, à partir de 2023 !
1.9k · artificial-intelligence
partageaudio-generation
nuwa-pytorch
Implémentation de NÜWA, réseau d'attention à la pointe de la technologie pour la synthèse vidéo…
548 · artificial-intelligence
partagetext-to-audio
YuE
YuE : Modèle de génération de musique de chanson complète open-source, quelque chose de similai…
6.3k · ai
partageaudio-generation
soundstorm-pytorch
Implémentation de SoundStorm, génération audio parallèle efficace de Google Deepmind, en Pytorc…
1.5k · artificial-intelligence
partageaudio-generation
Awesome-Medical-Large-Language-Models
Articles sélectionnés sur les grands modèles de langage dans le domaine de la santé et médical
393 · large-language-models
partagemultimodal-large-language-models

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.