Início Projetos MM-Diffusion
MM-Diffusion
Python

MM-Diffusion

[CVPR'23] MM-Diffusion: Aprendendo Modelos de Difusão Multimodal para Geração Conjunta de Áudio e Vídeo

por researchmm · GitHub
Estrelas
Forks
Licença
Criado
Último commit
Linguagem
audio-generationcontent-creationdiffusion-modelsMITPython
Ver no GitHub
Em palavras simples

Gere conteúdo de áudio e vídeo sincronizado usando um novo modelo de IA projetado para ambos os tipos de mídia.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
MM-Diffusion — GitHub preview card
📈 Histórico de estrelas
454453
2026-07-202026-08-31
📈 Acompanhe MM-Diffusion

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

[CVPR'23] MM-Diffusion: Aprendendo Modelos de Difusão Multimodal para Geração Conjunta de Áudio e Vídeo

MM-Diffusion tem 453 estrelas no GitHub. Foi bifurcado 24 vezes. MM-Diffusion é escrito principalmente em Python. Está em desenvolvimento ativo desde 2022. MM-Diffusion está disponível sob a licença MIT. Os seus principais temas são: audio-generation, content-creation, diffusion-models, multi-modality.

Frequently asked questions

O que é MM-Diffusion?

[CVPR'23] MM-Diffusion: Aprendendo Modelos de Difusão Multimodal para Geração Conjunta de Áudio e Vídeo

MM-Diffusion é de código aberto?

MM-Diffusion é um projeto de código aberto. É distribuído sob a licença MIT.

MM-Diffusion é gratuito?

Sim. MM-Diffusion é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está MM-Diffusion?

MM-Diffusion está disponível sob a licença MIT.

Em que linguagem MM-Diffusion está escrito?

MM-Diffusion é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — MM-Diffusion

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=researchmm-mm-diffusion)](https://olud.ai/project/researchmm-mm-diffusion.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
AudioStory
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
301 · audio-generation
partilhaaudio-generationdiffusion-models
tango
Uma família de modelos de difusão para geração de texto para áudio.
1.2k · audio-generation
partilhaaudio-generationdiffusion-models
audio-ai-timeline
Uma linha do tempo dos modelos de IA mais recentes para geração de áudio, começando em 2023!
1.9k · artificial-intelligence
partilhaaudio-generation
RLHF-V
[CVPR'24] RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correction…
310 · chatbot
partilhamulti-modality
deep-daze
Ferramenta simples de linha de comando para geração de texto para imagem usando CLIP da OpenAI…
4.3k · artificial-intelligence
partilhamulti-modality
YuE
YuE: Modelo de Geração de Música Completa, algo semelhante ao Suno.ai, mas aberto
6.3k · ai
partilhaaudio-generation
soundstorm-pytorch
Implementação do SoundStorm, Geração de Áudio Paralela Eficiente do Google Deepmind, em Pytorch
1.5k · artificial-intelligence
partilhaaudio-generation
audio-diffusion-pytorch
Geração de áudio usando modelos de difusão, em PyTorch.
2.1k · artificial-intelligence
partilhaaudio-generation
Dia-TTS-Server
Auto-hospede o poderoso modelo Dia TTS. Este servidor oferece uma interface Web amigável, endpo…
352 · ai
partilhaaudio-generation
CosyVoice
Modelo de geração de voz grande multilíngue, fornecendo capacidade completa de inferência, trei…
22.2k · audio-generation
partilhaaudio-generation

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.