Inicio Proyectos AudioStory
AudioStory
Jupyter Notebook

AudioStory

AudioStory: Generando audio narrativo de larga duración con grandes modelos de lenguaje

por TencentARC · GitHub
Estrellas
Ramas
Creado
Último commit
audio-generationdiffusion-modelsmultimodal-large-language-modelsJupyter Notebook
Ver en GitHub
En palabras simples

Genera largas historias de audio a partir de texto, o dobla videos con audio utilizando un modelo simple.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
AudioStory — GitHub preview card
📈 Historial de estrellas
302301
2026-07-202026-08-14
📈 Sigue AudioStory

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

AudioStory: Generando audio narrativo de larga duración con grandes modelos de lenguaje

AudioStory tiene 301 estrellas en GitHub. Se ha bifurcado 22 veces. AudioStory está escrito principalmente en Jupyter Notebook. Se desarrolla activamente desde 2025. Sus temas principales son: audio-generation, diffusion-models, multimodal-large-language-models, text-to-audio.

Frequently asked questions

¿Qué es AudioStory?

AudioStory: Generando audio narrativo de larga duración con grandes modelos de lenguaje

¿AudioStory es de código abierto?

AudioStory es un proyecto de código abierto.

¿AudioStory es gratis?

Sí. AudioStory es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿En qué lenguaje está escrito AudioStory?

AudioStory está escrito principalmente en Jupyter Notebook.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — AudioStory

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=tencentarc-audiostory)](https://olud.ai/project/tencentarc-audiostory.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
tango
Una familia de modelos de difusión para generación de texto a audio.
1.2k · audio-generation
compartetext-to-audioaudio-generation
EzAudio
Generación de Texto a Audio de Alta Calidad con Transformador de Difusión Eficiente
333 · diffusion-models
compartetext-to-audiodiffusion-models
mustango
Mustango: Hacia la generación controlable de texto a música
394 · diffusion-models
compartetext-to-audiodiffusion-models
Make-An-Audio
Implementación en PyTorch de Make-An-Audio (ICML'23) con un modelo generativo de texto a audio
669 · diffusion-models
compartetext-to-audiodiffusion-models
MM-Diffusion
[CVPR'23] MM-Diffusion: Aprendiendo Modelos de Difusión Multimodal para Generación Conjunta de…
453 · audio-generation
comparteaudio-generationdiffusion-models
audio-ai-timeline
¡Una línea de tiempo de los últimos modelos de IA para generación de audio, comenzando en 2023!
1.9k · artificial-intelligence
comparteaudio-generation
nuwa-pytorch
Implementación de NÜWA, red de atención de última generación para síntesis de texto a video, en…
548 · artificial-intelligence
compartetext-to-audio
YuE
YuE: Modelo de Fundación de Generación de Música de Canciones Completas Abierto, algo similar a…
6.3k · ai
comparteaudio-generation
soundstorm-pytorch
Implementación de SoundStorm, generación de audio paralelo eficiente de Google Deepmind, en Pyt…
1.5k · artificial-intelligence
comparteaudio-generation
Awesome-Medical-Large-Language-Models
Artículos seleccionados sobre Modelos de Lenguaje Grande en el ámbito de la Salud y Medicina
393 · large-language-models
compartemultimodal-large-language-models

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.