Accueil Projets AudioStory
AudioStory

AudioStory

par TencentARC · GitHub

AudioStory : Génération d'audio narratif long avec de grands modèles de langage

Voir sur GitHub
⭐ Étoiles
🍴 Forks
📜 Licence
Licence non spécifiée
📅 Créé
🔄 Dernier commit
🏷️ Catégorie
💻 Langue
Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
AudioStory — GitHub preview card
📈 Historique des étoiles
302301
2026-07-202026-07-29
📈 Suivez AudioStory

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

AudioStory : Génération d'audio narratif long avec de grands modèles de langage

AudioStory compte 301 étoiles sur GitHub. Il a été forké 22 fois. AudioStory est écrit principalement en Jupyter Notebook. Il est développé activement depuis 2025. Ses principaux thèmes sont : audio-generation, diffusion-models, multimodal-large-language-models, text-to-audio.

Frequently asked questions

Qu'est-ce que AudioStory ?

AudioStory : Génération d'audio narratif long avec de grands modèles de langage

AudioStory est-il open source ?

AudioStory est un projet open source.

AudioStory est-il gratuit ?

Oui. AudioStory est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Dans quel langage AudioStory est-il écrit ?

AudioStory est écrit principalement en Jupyter Notebook.

🏅 Mainteneur de ce projet ?
OpenSourceAI badge — AudioStory

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=tencentarc-audiostory)](https://opensourceai.tech/project/tencentarc-audiostory.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
Make-An-Audio
Implémentation PyTorch de Make-An-Audio (ICML'23) avec un modèle génératif texte-à-audio
669 · diffusion-models
partagevideo-to-audiotext-to-audio
tango
Une famille de modèles de diffusion pour la génération de texte à audio.
1.2k · audio-generation
partagetext-to-audioaudio-generation
MMAudio
[CVPR 2025] MMAudio : Dompter l'entraînement joint multimodal pour la synthèse vidéo-à-audio de…
2.2k · audio
partagevideo-to-audiotext-to-audio
EzAudio
Génération de texte en audio de haute qualité avec Efficient Diffusion Transformer
333 · diffusion-models
partagetext-to-audiodiffusion-models
mustango
Mustango : Vers une génération de musique contrôlable à partir de texte
394 · diffusion-models
partagetext-to-audiodiffusion-models
FoleyCrafter
[IJCV 2026] FoleyCrafter : Donnez vie aux vidéos silencieuses avec des sons réalistes et synchr…
658 · aigc
partagevideo-to-audiodiffusion-models
MM-Diffusion
[CVPR'23] MM-Diffusion : Apprentissage de modèles de diffusion multimodaux pour la génération c…
453 · audio-generation
partageaudio-generationdiffusion-models
LocalAI
LocalAI est le moteur AI open-source. Exécutez n'importe quel modèle - LLMs, vision, voix, imag…
48k · agents
CosyVoice
Modèle de génération vocale multilingue, offrant des capacités complètes d'inférence, d'entraîn…
22.5k · audio-generation
Amphion
Amphion (/æmˈfaɪən/) est un ensemble d'outils pour la génération audio, musicale et de discours…
10k · audio-generation

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.