Home Progetti MM-Diffusion
MM-Diffusion
Python

MM-Diffusion

[CVPR'23] MM-Diffusion: Apprendimento di modelli di diffusione multimodali per la generazione congiunta di audio e video

di researchmm · GitHub
Stelle
Fork
Licenza
Creato
Ultimo commit
Lingua
audio-generationcontent-creationdiffusion-modelsMITPython
Visualizza su GitHub
In parole semplici

Genera contenuti audio e video sincronizzati utilizzando un nuovo modello AI progettato per entrambi i tipi di media.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
MM-Diffusion — GitHub preview card
📈 Storia delle stelle
454453
2026-07-202026-08-31
📈 Segui MM-Diffusion

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

[CVPR'23] MM-Diffusion: Apprendimento di modelli di diffusione multimodali per la generazione congiunta di audio e video

MM-Diffusion ha 453 stelle su GitHub. È stato forkato 24 volte. MM-Diffusion è scritto principalmente in Python. È in sviluppo attivo dal 2022. MM-Diffusion è disponibile con licenza MIT. I suoi temi principali sono: audio-generation, content-creation, diffusion-models, multi-modality.

Frequently asked questions

Che cos'è MM-Diffusion?

[CVPR'23] MM-Diffusion: Apprendimento di modelli di diffusione multimodali per la generazione congiunta di audio e video

MM-Diffusion è open source?

MM-Diffusion è un progetto open source. È rilasciato con licenza MIT.

MM-Diffusion è gratuito?

Sì. MM-Diffusion è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è MM-Diffusion?

MM-Diffusion è disponibile con licenza MIT.

In quale linguaggio è scritto MM-Diffusion?

MM-Diffusion è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — MM-Diffusion

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=researchmm-mm-diffusion)](https://olud.ai/project/researchmm-mm-diffusion.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
AudioStory
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
301 · audio-generation
condivideaudio-generationdiffusion-models
tango
Una famiglia di modelli di diffusione per la generazione di testo in audio.
1.2k · audio-generation
condivideaudio-generationdiffusion-models
audio-ai-timeline
Una cronologia dei modelli AI più recenti per la generazione audio, a partire dal 2023!
1.9k · artificial-intelligence
condivideaudio-generation
RLHF-V
[CVPR'24] RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correction…
310 · chatbot
condividemulti-modality
deep-daze
Strumento da riga di comando semplice per la generazione di immagini da testo utilizzando CLIP…
4.3k · artificial-intelligence
condividemulti-modality
YuE
YuE: Modello di generazione musicale open full-song, qualcosa di simile a Suno.ai ma open
6.3k · ai
condivideaudio-generation
soundstorm-pytorch
Implementazione di SoundStorm, generazione audio parallela efficiente da Google Deepmind, in Py…
1.5k · artificial-intelligence
condivideaudio-generation
audio-diffusion-pytorch
Generazione audio utilizzando modelli di diffusione, in PyTorch.
2.1k · artificial-intelligence
condivideaudio-generation
Dia-TTS-Server
Auto-ospita il potente modello Dia TTS. Questo server offre un'interfaccia Web user-friendly, e…
352 · ai
condivideaudio-generation
CosyVoice
Modello di generazione vocale multilingue di grandi dimensioni, che fornisce capacità complete…
22.2k · audio-generation
condivideaudio-generation

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.