Inicio Proyectos Make-An-Audio
Make-An-Audio

Make-An-Audio

por Text-to-Audio · GitHub

Implementación en PyTorch de Make-An-Audio (ICML'23) con un modelo generativo de texto a audio

Ver en GitHub
En palabras simples

Genera audio de alta calidad a partir de texto utilizando un modelo de aprendizaje automático, con ejemplos disponibles para probar.

⭐ Estrellas
🍴 Ramas
📜 Licencia
Uso comercial permitido
📅 Creado
🔄 Último commit
🏷️ Categoría
💻 Lenguaje
¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
Make-An-Audio — GitHub preview card
📈 Historial de estrellas
670669
2026-07-202026-07-29
📈 Sigue Make-An-Audio

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Implementación en PyTorch de Make-An-Audio (ICML'23) con un modelo generativo de texto a audio

Make-An-Audio tiene 669 estrellas en GitHub. Se ha bifurcado 92 veces. Make-An-Audio está escrito principalmente en Python. Se desarrolla activamente desde 2023. Make-An-Audio está disponible bajo la licencia MIT. Sus temas principales son: diffusion-models, latent-diffusion, latent-space, text-to-audio.

Frequently asked questions

¿Qué es Make-An-Audio?

Implementación en PyTorch de Make-An-Audio (ICML'23) con un modelo generativo de texto a audio

¿Make-An-Audio es de código abierto?

Make-An-Audio es un proyecto de código abierto. Se distribuye bajo la licencia MIT.

¿Make-An-Audio es gratis?

Sí. Make-An-Audio es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está Make-An-Audio?

Make-An-Audio está disponible bajo la licencia MIT.

¿En qué lenguaje está escrito Make-An-Audio?

Make-An-Audio está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
OpenSourceAI badge — Make-An-Audio

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=text-to-audio-make-an-audio)](https://opensourceai.tech/project/text-to-audio-make-an-audio.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
AudioStory
AudioStory: Generando audio narrativo de larga duración con grandes modelos de lenguaje
301 · audio-generation
compartevideo-to-audiotext-to-audio
MMAudio
[CVPR 2025] MMAudio: Domando el Entrenamiento Conjunto Multimodal para la Síntesis de Video a A…
2.2k · audio
compartevideo-to-audiotext-to-audio
EzAudio
Generación de Texto a Audio de Alta Calidad con Transformador de Difusión Eficiente
333 · diffusion-models
compartetext-to-audiodiffusion-models
mustango
Mustango: Hacia la generación controlable de texto a música
394 · diffusion-models
compartetext-to-audiodiffusion-models
audio-diffusion
Aplica modelos de difusión utilizando el nuevo paquete de difusores de Hugging Face para sintet…
792 · diffusion-models
compartelatent-diffusiondiffusion-models
FoleyCrafter
[IJCV 2026] FoleyCrafter: Da vida a videos silenciosos con sonidos realistas y sincronizados. A…
658 · aigc
compartevideo-to-audiodiffusion-models
LFM
Implementación oficial en PyTorch del artículo: Coincidencia de flujo en espacio latente
357 · conditional-normalizing-flows
compartelatent-spacediffusion-models
tango
Una familia de modelos de difusión para generación de texto a audio.
1.2k · audio-generation
compartetext-to-audiodiffusion-models
One-DM
Código Oficial para el artículo de ECCV 2024 — Mimador de Difusión de Una Sola Toma para Genera…
559 · computer-vision
compartelatent-diffusiondiffusion-models
DiffusionFastForward
DiffusionFastForward: un curso gratuito y marco experimental para modelos generativos basados e…
682 · diffusion-model
compartelatent-diffusiondiffusion-models

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.