Accueil Projets EzAudio
EzAudio
Python

EzAudio

Génération de texte en audio de haute qualité avec Efficient Diffusion Transformer

par haidog-yaqub · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Langue
diffusion-modelsgenerative-aitext-to-audioMITPython
Voir sur GitHub
En termes simples

Générez un audio de haute qualité à partir de texte en utilisant un modèle basé sur la diffusion avec des besoins computationnels réduits.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
EzAudio — GitHub preview card
📈 Historique des étoiles
333332
2026-07-202026-08-31
📈 Suivez EzAudio

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Génération de texte en audio de haute qualité avec Efficient Diffusion Transformer

EzAudio compte 332 étoiles sur GitHub. Il a été forké 25 fois. EzAudio est écrit principalement en Python. Il est développé activement depuis 2024. EzAudio est disponible sous licence MIT. Ses principaux thèmes sont : diffusion-models, generative-ai, text-to-audio.

Frequently asked questions

Qu'est-ce que EzAudio ?

Génération de texte en audio de haute qualité avec Efficient Diffusion Transformer

EzAudio est-il open source ?

EzAudio est un projet open source. Il est distribué sous licence MIT.

EzAudio est-il gratuit ?

Oui. EzAudio est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est EzAudio ?

EzAudio est disponible sous licence MIT.

Dans quel langage EzAudio est-il écrit ?

EzAudio est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — EzAudio

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=haidog-yaqub-ezaudio)](https://olud.ai/project/haidog-yaqub-ezaudio.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
mustango
Mustango : Vers une génération de musique contrôlable à partir de texte
395 · diffusion-models
partagetext-to-audiodiffusion-models
AudioStory
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
301 · audio-generation
partagetext-to-audiodiffusion-models
Make-An-Audio
Implémentation PyTorch de Make-An-Audio (ICML'23) avec un modèle génératif texte-à-audio
669 · diffusion-models
partagetext-to-audiodiffusion-models
tango
Une famille de modèles de diffusion pour la génération de texte à audio.
1.2k · audio-generation
partagetext-to-audiodiffusion-models
nuwa-pytorch
Implémentation de NÜWA, réseau d'attention à la pointe de la technologie pour la synthèse vidéo…
548 · artificial-intelligence
partagetext-to-audio
Open-dLLM
Modèle de langage de diffusion ouvert pour la génération de code — publication de pré-entraînem…
649 · diffusion-models
partagediffusion-models
MimicMotion
Génération de vidéos de mouvement humain de haute qualité avec guidage de pose conscient de la…
2.6k · diffusion-models
partagediffusion-models
PVDM
[CVPR'23] Modèles de diffusion probabilistes vidéo dans l'espace latent projeté
322 · diffusion-models
partagediffusion-models
REPA
[ICLR'25 Oral] Alignement de représentation pour la génération : Entraîner des transformateurs…
1.7k · diffusion
partagediffusion-models
Paella
Mise en œuvre officielle de Paella https://arxiv.org/abs/2211.07292v2
748 · diffusion-models
partagediffusion-models

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.