Início Projetos AudioStory
AudioStory
Jupyter Notebook

AudioStory

AudioStory: Gerando Áudio Narrativo de Longo Formato com Modelos de Linguagem Grande

por TencentARC · GitHub
Estrelas
Forks
Criado
Último commit
audio-generationdiffusion-modelsmultimodal-large-language-modelsJupyter Notebook
Ver no GitHub
Em palavras simples

Gere longas histórias em áudio a partir de texto ou duble vídeos com áudio usando um modelo simples.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
AudioStory — GitHub preview card
📈 Histórico de estrelas
302301
2026-07-202026-08-14
📈 Acompanhe AudioStory

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

AudioStory: Gerando Áudio Narrativo de Longo Formato com Modelos de Linguagem Grande

AudioStory tem 301 estrelas no GitHub. Foi bifurcado 22 vezes. AudioStory é escrito principalmente em Jupyter Notebook. Está em desenvolvimento ativo desde 2025. Os seus principais temas são: audio-generation, diffusion-models, multimodal-large-language-models, text-to-audio.

Frequently asked questions

O que é AudioStory?

AudioStory: Gerando Áudio Narrativo de Longo Formato com Modelos de Linguagem Grande

AudioStory é de código aberto?

AudioStory é um projeto de código aberto.

AudioStory é gratuito?

Sim. AudioStory é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Em que linguagem AudioStory está escrito?

AudioStory é escrito principalmente em Jupyter Notebook.

🏅 Mantenedor deste projeto?
olud.ai badge — AudioStory

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=tencentarc-audiostory)](https://olud.ai/project/tencentarc-audiostory.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
tango
Uma família de modelos de difusão para geração de texto para áudio.
1.2k · audio-generation
partilhatext-to-audioaudio-generation
EzAudio
Geração de Texto-para-Aúdio de alta qualidade com Transformador de Difusão Eficiente
333 · diffusion-models
partilhatext-to-audiodiffusion-models
mustango
Mustango: Rumo à Geração Controlável de Texto para Música
394 · diffusion-models
partilhatext-to-audiodiffusion-models
Make-An-Audio
Implementação em PyTorch de Make-An-Audio (ICML'23) com um Modelo Generativo de Texto para Áudi…
669 · diffusion-models
partilhatext-to-audiodiffusion-models
MM-Diffusion
[CVPR'23] MM-Diffusion: Aprendendo Modelos de Difusão Multimodal para Geração Conjunta de Áudio…
453 · audio-generation
partilhaaudio-generationdiffusion-models
audio-ai-timeline
Uma linha do tempo dos modelos de IA mais recentes para geração de áudio, começando em 2023!
1.9k · artificial-intelligence
partilhaaudio-generation
nuwa-pytorch
Implementação do NÜWA, rede de atenção de ponta para síntese de vídeo a partir de texto, em Pyt…
548 · artificial-intelligence
partilhatext-to-audio
YuE
YuE: Modelo de Geração de Música Completa, algo semelhante ao Suno.ai, mas aberto
6.3k · ai
partilhaaudio-generation
soundstorm-pytorch
Implementação do SoundStorm, Geração de Áudio Paralela Eficiente do Google Deepmind, em Pytorch
1.5k · artificial-intelligence
partilhaaudio-generation
Awesome-Medical-Large-Language-Models
Artigos selecionados sobre Modelos de Linguagem Grande no setor de Saúde e Medicina
393 · large-language-models
partilhamultimodal-large-language-models

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.