Inicio Proyectos MM-Diffusion
MM-Diffusion
Python

MM-Diffusion

[CVPR'23] MM-Diffusion: Aprendiendo Modelos de Difusión Multimodal para Generación Conjunta de Audio y Video

por researchmm · GitHub
Estrellas
Ramas
Licencia
Creado
Último commit
Lenguaje
audio-generationcontent-creationdiffusion-modelsMITPython
Ver en GitHub
En palabras simples

Genera contenido de audio y video sincronizado utilizando un nuevo modelo de IA diseñado para ambos tipos de medios.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
MM-Diffusion — GitHub preview card
📈 Historial de estrellas
454453
2026-07-202026-08-31
📈 Sigue MM-Diffusion

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

[CVPR'23] MM-Diffusion: Aprendiendo Modelos de Difusión Multimodal para Generación Conjunta de Audio y Video

MM-Diffusion tiene 453 estrellas en GitHub. Se ha bifurcado 24 veces. MM-Diffusion está escrito principalmente en Python. Se desarrolla activamente desde 2022. MM-Diffusion está disponible bajo la licencia MIT. Sus temas principales son: audio-generation, content-creation, diffusion-models, multi-modality.

Frequently asked questions

¿Qué es MM-Diffusion?

[CVPR'23] MM-Diffusion: Aprendiendo Modelos de Difusión Multimodal para Generación Conjunta de Audio y Video

¿MM-Diffusion es de código abierto?

MM-Diffusion es un proyecto de código abierto. Se distribuye bajo la licencia MIT.

¿MM-Diffusion es gratis?

Sí. MM-Diffusion es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está MM-Diffusion?

MM-Diffusion está disponible bajo la licencia MIT.

¿En qué lenguaje está escrito MM-Diffusion?

MM-Diffusion está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — MM-Diffusion

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=researchmm-mm-diffusion)](https://olud.ai/project/researchmm-mm-diffusion.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
AudioStory
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
301 · audio-generation
comparteaudio-generationdiffusion-models
tango
Una familia de modelos de difusión para generación de texto a audio.
1.2k · audio-generation
comparteaudio-generationdiffusion-models
audio-ai-timeline
¡Una línea de tiempo de los últimos modelos de IA para generación de audio, comenzando en 2023!
1.9k · artificial-intelligence
comparteaudio-generation
RLHF-V
[CVPR'24] RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correction…
310 · chatbot
compartemulti-modality
deep-daze
Herramienta de línea de comandos simple para generación de texto a imagen utilizando CLIP de Op…
4.3k · artificial-intelligence
compartemulti-modality
YuE
YuE: Modelo de Fundación de Generación de Música de Canciones Completas Abierto, algo similar a…
6.3k · ai
comparteaudio-generation
soundstorm-pytorch
Implementación de SoundStorm, generación de audio paralelo eficiente de Google Deepmind, en Pyt…
1.5k · artificial-intelligence
comparteaudio-generation
audio-diffusion-pytorch
Generación de audio utilizando modelos de difusión, en PyTorch.
2.1k · artificial-intelligence
comparteaudio-generation
Dia-TTS-Server
Autoalojar el poderoso modelo Dia TTS. Este servidor ofrece una interfaz web fácil de usar, pun…
352 · ai
comparteaudio-generation
CosyVoice
Modelo de generación de voz grande multilingüe, proporcionando capacidad de inferencia, entrena…
22.2k · audio-generation
comparteaudio-generation

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.