Início Projetos Make-An-Audio
Make-An-Audio

Make-An-Audio

por Text-to-Audio · GitHub

Implementação em PyTorch de Make-An-Audio (ICML'23) com um Modelo Generativo de Texto para Áudio

Ver no GitHub
Em palavras simples

Gere áudio de alta qualidade a partir de texto usando um modelo de aprendizado de máquina, com exemplos disponíveis para testar.

⭐ Estrelas
🍴 Forks
📜 Licença
Uso comercial permitido
📅 Criado
🔄 Último commit
🏷️ Categoria
💻 Linguagem
Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
Make-An-Audio — GitHub preview card
📈 Histórico de estrelas
670669
2026-07-202026-07-29
📈 Acompanhe Make-An-Audio

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

Implementação em PyTorch de Make-An-Audio (ICML'23) com um Modelo Generativo de Texto para Áudio

Make-An-Audio tem 669 estrelas no GitHub. Foi bifurcado 92 vezes. Make-An-Audio é escrito principalmente em Python. Está em desenvolvimento ativo desde 2023. Make-An-Audio está disponível sob a licença MIT. Os seus principais temas são: diffusion-models, latent-diffusion, latent-space, text-to-audio.

Frequently asked questions

O que é Make-An-Audio?

Implementação em PyTorch de Make-An-Audio (ICML'23) com um Modelo Generativo de Texto para Áudio

Make-An-Audio é de código aberto?

Make-An-Audio é um projeto de código aberto. É distribuído sob a licença MIT.

Make-An-Audio é gratuito?

Sim. Make-An-Audio é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está Make-An-Audio?

Make-An-Audio está disponível sob a licença MIT.

Em que linguagem Make-An-Audio está escrito?

Make-An-Audio é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
OpenSourceAI badge — Make-An-Audio

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=text-to-audio-make-an-audio)](https://opensourceai.tech/project/text-to-audio-make-an-audio.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
AudioStory
AudioStory: Gerando áudio narrativo de longa duração com grandes modelos de linguagem
301 · audio-generation
partilhavideo-to-audiotext-to-audio
MMAudio
[CVPR 2025] MMAudio: Domando o Treinamento Conjunto Multimodal para Síntese de Vídeo para Áudio…
2.2k · audio
partilhavideo-to-audiotext-to-audio
EzAudio
Geração de Texto-para-Aúdio de alta qualidade com Transformador de Difusão Eficiente
333 · diffusion-models
partilhatext-to-audiodiffusion-models
mustango
Mustango: Rumo à Geração Controlável de Texto para Música
394 · diffusion-models
partilhatext-to-audiodiffusion-models
audio-diffusion
Aplique modelos de difusão usando o novo pacote de difusores da Hugging Face para sintetizar mú…
792 · diffusion-models
partilhalatent-diffusiondiffusion-models
FoleyCrafter
[IJCV 2026] FoleyCrafter: Dê vida a vídeos silenciosos com sons realistas e sincronizados. AI拟音…
658 · aigc
partilhavideo-to-audiodiffusion-models
LFM
Implementação oficial em PyTorch do artigo: Correspondência de Fluxo em Espaço Latente
357 · conditional-normalizing-flows
partilhalatent-spacediffusion-models
tango
Uma família de modelos de difusão para geração de texto para áudio.
1.2k · audio-generation
partilhatext-to-audiodiffusion-models
One-DM
Código Oficial para o artigo ECCV 2024 — Mimicker de Difusão de Uma Única Amostra para Geração…
559 · computer-vision
partilhalatent-diffusiondiffusion-models
DiffusionFastForward
DiffusionFastForward: um curso gratuito e framework experimental para modelos generativos basea…
682 · diffusion-model
partilhalatent-diffusiondiffusion-models

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.