Início Projetos EzAudio
EzAudio

EzAudio

por haidog-yaqub · GitHub

Geração de Texto-para-Aúdio de alta qualidade com Transformador de Difusão Eficiente

Ver no GitHub
⭐ Estrelas
🍴 Forks
📜 Licença
Uso comercial permitido
📅 Criado
🔄 Último commit
🏷️ Categoria
💻 Linguagem
Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
EzAudio — GitHub preview card
📈 Histórico de estrelas
334333
2026-07-202026-07-29
📈 Acompanhe EzAudio

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

Geração de Texto-para-Aúdio de alta qualidade com Transformador de Difusão Eficiente

EzAudio tem 333 estrelas no GitHub. Foi bifurcado 25 vezes. EzAudio é escrito principalmente em Python. Está em desenvolvimento ativo desde 2024. EzAudio está disponível sob a licença MIT. Os seus principais temas são: diffusion-models, generative-ai, text-to-audio.

Frequently asked questions

O que é EzAudio?

Geração de Texto-para-Aúdio de alta qualidade com Transformador de Difusão Eficiente

EzAudio é de código aberto?

EzAudio é um projeto de código aberto. É distribuído sob a licença MIT.

EzAudio é gratuito?

Sim. EzAudio é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está EzAudio?

EzAudio está disponível sob a licença MIT.

Em que linguagem EzAudio está escrito?

EzAudio é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
OpenSourceAI badge — EzAudio

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=haidog-yaqub-ezaudio)](https://opensourceai.tech/project/haidog-yaqub-ezaudio.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
mustango
Mustango: Rumo à Geração Controlável de Texto para Música
394 · diffusion-models
partilhatext-to-audiodiffusion-models
tango
Uma família de modelos de difusão para geração de texto para áudio.
1.2k · audio-generation
partilhatext-to-audiodiffusion-models
Make-An-Audio
Implementação em PyTorch de Make-An-Audio (ICML'23) com um Modelo Generativo de Texto para Áudi…
669 · diffusion-models
partilhatext-to-audiodiffusion-models
AudioStory
AudioStory: Gerando áudio narrativo de longa duração com grandes modelos de linguagem
301 · audio-generation
partilhatext-to-audiodiffusion-models
Open-dLLM
Modelo de linguagem de difusão aberta para geração de código — liberando pré-treinamento, avali…
643 · diffusion-models
partilhadiffusion-models
nuwa-pytorch
Implementação do NÜWA, rede de atenção de ponta para síntese de vídeo a partir de texto, em Pyt…
548 · artificial-intelligence
partilhatext-to-audio
MimicMotion
Geração de Vídeo de Movimento Humano de Alta Qualidade com Orientação de Pose Ciente de Confian…
2.6k · diffusion-models
partilhadiffusion-models
PVDM
[CVPR'23] Modelos de Difusão Probabilística de Vídeo em Espaço Latente Projetado
322 · diffusion-models
partilhadiffusion-models
Awesome-diffusion-model-for-image-processing
um resumo do processamento de imagem baseado em difusão, incluindo restauração, aprimoramento,…
954 · diffusion-models
partilhadiffusion-models
REPA
[ICLR'25 Oral] Alinhamento de Representação para Geração: Treinar Transformadores de Difusão É…
1.7k · diffusion
partilhadiffusion-models

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.