Accueil Projets MM-Diffusion
MM-Diffusion
Python

MM-Diffusion

[CVPR'23] MM-Diffusion : Apprentissage de modèles de diffusion multimodaux pour la génération conjointe d'audio et de vidéo

par researchmm · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Langue
audio-generationcontent-creationdiffusion-modelsMITPython
Voir sur GitHub
En termes simples

Générez du contenu audio et vidéo synchronisé en utilisant un nouveau modèle AI conçu pour les deux types de médias.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
MM-Diffusion — GitHub preview card
📈 Historique des étoiles
454453
2026-07-202026-08-31
📈 Suivez MM-Diffusion

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

[CVPR'23] MM-Diffusion : Apprentissage de modèles de diffusion multimodaux pour la génération conjointe d'audio et de vidéo

MM-Diffusion compte 453 étoiles sur GitHub. Il a été forké 24 fois. MM-Diffusion est écrit principalement en Python. Il est développé activement depuis 2022. MM-Diffusion est disponible sous licence MIT. Ses principaux thèmes sont : audio-generation, content-creation, diffusion-models, multi-modality.

Frequently asked questions

Qu'est-ce que MM-Diffusion ?

[CVPR'23] MM-Diffusion : Apprentissage de modèles de diffusion multimodaux pour la génération conjointe d'audio et de vidéo

MM-Diffusion est-il open source ?

MM-Diffusion est un projet open source. Il est distribué sous licence MIT.

MM-Diffusion est-il gratuit ?

Oui. MM-Diffusion est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est MM-Diffusion ?

MM-Diffusion est disponible sous licence MIT.

Dans quel langage MM-Diffusion est-il écrit ?

MM-Diffusion est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — MM-Diffusion

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=researchmm-mm-diffusion)](https://olud.ai/project/researchmm-mm-diffusion.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
AudioStory
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
301 · audio-generation
partageaudio-generationdiffusion-models
tango
Une famille de modèles de diffusion pour la génération de texte à audio.
1.2k · audio-generation
partageaudio-generationdiffusion-models
audio-ai-timeline
Une chronologie des derniers modèles d'IA pour la génération audio, à partir de 2023 !
1.9k · artificial-intelligence
partageaudio-generation
RLHF-V
[CVPR'24] RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correction…
310 · chatbot
partagemulti-modality
deep-daze
Outil de ligne de commande simple pour la génération d'images à partir de texte utilisant CLIP…
4.3k · artificial-intelligence
partagemulti-modality
YuE
YuE : Modèle de génération de musique de chanson complète open-source, quelque chose de similai…
6.3k · ai
partageaudio-generation
soundstorm-pytorch
Implémentation de SoundStorm, génération audio parallèle efficace de Google Deepmind, en Pytorc…
1.5k · artificial-intelligence
partageaudio-generation
audio-diffusion-pytorch
Génération audio utilisant des modèles de diffusion, en PyTorch.
2.1k · artificial-intelligence
partageaudio-generation
Dia-TTS-Server
Auto-hébergez le puissant modèle Dia TTS. Ce serveur offre une interface Web conviviale, des po…
352 · ai
partageaudio-generation
CosyVoice
Modèle de génération vocale multilingue, offrant des capacités complètes d'inférence, d'entraîn…
22.2k · audio-generation
partageaudio-generation

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.