[CVPR'23] MM-Diffusion : Apprentissage de modèles de diffusion multimodaux pour la génération conjointe d'audio et de vidéo
Générez du contenu audio et vidéo synchronisé en utilisant un nouveau modèle AI conçu pour les deux types de médias.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout moment[CVPR'23] MM-Diffusion : Apprentissage de modèles de diffusion multimodaux pour la génération conjointe d'audio et de vidéo
MM-Diffusion compte 453 étoiles sur GitHub. Il a été forké 24 fois. MM-Diffusion est écrit principalement en Python. Il est développé activement depuis 2022. MM-Diffusion est disponible sous licence MIT. Ses principaux thèmes sont : audio-generation, content-creation, diffusion-models, multi-modality.
[CVPR'23] MM-Diffusion : Apprentissage de modèles de diffusion multimodaux pour la génération conjointe d'audio et de vidéo
MM-Diffusion est un projet open source. Il est distribué sous licence MIT.
Oui. MM-Diffusion est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
MM-Diffusion est disponible sous licence MIT.
MM-Diffusion est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://olud.ai/project/researchmm-mm-diffusion.html)
Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.