Início Projetos EzAudio
EzAudio
Python

EzAudio

Geração de Texto-para-Aúdio de alta qualidade com Transformador de Difusão Eficiente

por haidog-yaqub · GitHub
Estrelas
Forks
Licença
Criado
Último commit
Linguagem
diffusion-modelsgenerative-aitext-to-audioMITPython
Ver no GitHub
Em palavras simples

Gere áudio de alta qualidade a partir de texto usando um modelo baseado em difusão com menores necessidades computacionais.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
EzAudio — GitHub preview card
📈 Histórico de estrelas
333332
2026-07-202026-08-31
📈 Acompanhe EzAudio

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

Geração de Texto-para-Aúdio de alta qualidade com Transformador de Difusão Eficiente

EzAudio tem 332 estrelas no GitHub. Foi bifurcado 25 vezes. EzAudio é escrito principalmente em Python. Está em desenvolvimento ativo desde 2024. EzAudio está disponível sob a licença MIT. Os seus principais temas são: diffusion-models, generative-ai, text-to-audio.

Frequently asked questions

O que é EzAudio?

Geração de Texto-para-Aúdio de alta qualidade com Transformador de Difusão Eficiente

EzAudio é de código aberto?

EzAudio é um projeto de código aberto. É distribuído sob a licença MIT.

EzAudio é gratuito?

Sim. EzAudio é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está EzAudio?

EzAudio está disponível sob a licença MIT.

Em que linguagem EzAudio está escrito?

EzAudio é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — EzAudio

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=haidog-yaqub-ezaudio)](https://olud.ai/project/haidog-yaqub-ezaudio.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
mustango
Mustango: Rumo à Geração Controlável de Texto para Música
395 · diffusion-models
partilhatext-to-audiodiffusion-models
AudioStory
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
301 · audio-generation
partilhatext-to-audiodiffusion-models
Make-An-Audio
Implementação em PyTorch de Make-An-Audio (ICML'23) com um Modelo Generativo de Texto para Áudi…
669 · diffusion-models
partilhatext-to-audiodiffusion-models
tango
Uma família de modelos de difusão para geração de texto para áudio.
1.2k · audio-generation
partilhatext-to-audiodiffusion-models
nuwa-pytorch
Implementação do NÜWA, rede de atenção de ponta para síntese de vídeo a partir de texto, em Pyt…
548 · artificial-intelligence
partilhatext-to-audio
Open-dLLM
Modelo de linguagem de difusão aberta para geração de código — liberando pré-treinamento, avali…
649 · diffusion-models
partilhadiffusion-models
MimicMotion
Geração de Vídeo de Movimento Humano de Alta Qualidade com Orientação de Pose Ciente de Confian…
2.6k · diffusion-models
partilhadiffusion-models
PVDM
[CVPR'23] Modelos de Difusão Probabilística de Vídeo em Espaço Latente Projetado
322 · diffusion-models
partilhadiffusion-models
REPA
[ICLR'25 Oral] Alinhamento de Representação para Geração: Treinar Transformadores de Difusão É…
1.7k · diffusion
partilhadiffusion-models
Paella
Implementação oficial do Paella https://arxiv.org/abs/2211.07292v2
748 · diffusion-models
partilhadiffusion-models

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.