Início Projetos AudioStory
AudioStory

AudioStory

por TencentARC · GitHub

AudioStory: Gerando áudio narrativo de longa duração com grandes modelos de linguagem

Ver no GitHub
⭐ Estrelas
🍴 Forks
📜 Licença
Licença não especificada
📅 Criado
🔄 Último commit
🏷️ Categoria
💻 Linguagem
Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
AudioStory — GitHub preview card
📈 Histórico de estrelas
302301
2026-07-202026-07-29
📈 Acompanhe AudioStory

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

AudioStory: Gerando áudio narrativo de longa duração com grandes modelos de linguagem

AudioStory tem 301 estrelas no GitHub. Foi bifurcado 22 vezes. AudioStory é escrito principalmente em Jupyter Notebook. Está em desenvolvimento ativo desde 2025. Os seus principais temas são: audio-generation, diffusion-models, multimodal-large-language-models, text-to-audio.

Frequently asked questions

O que é AudioStory?

AudioStory: Gerando áudio narrativo de longa duração com grandes modelos de linguagem

AudioStory é de código aberto?

AudioStory é um projeto de código aberto.

AudioStory é gratuito?

Sim. AudioStory é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Em que linguagem AudioStory está escrito?

AudioStory é escrito principalmente em Jupyter Notebook.

🏅 Mantenedor deste projeto?
olud.ai badge — AudioStory

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=tencentarc-audiostory)](https://olud.ai/project/tencentarc-audiostory.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
Make-An-Audio
Implementação em PyTorch de Make-An-Audio (ICML'23) com um Modelo Generativo de Texto para Áudi…
669 · diffusion-models
partilhavideo-to-audiotext-to-audio
tango
Uma família de modelos de difusão para geração de texto para áudio.
1.2k · audio-generation
partilhatext-to-audioaudio-generation
MMAudio
[CVPR 2025] MMAudio: Domando o Treinamento Conjunto Multimodal para Síntese de Vídeo para Áudio…
2.2k · audio
partilhavideo-to-audiotext-to-audio
EzAudio
Geração de Texto-para-Aúdio de alta qualidade com Transformador de Difusão Eficiente
333 · diffusion-models
partilhatext-to-audiodiffusion-models
mustango
Mustango: Rumo à Geração Controlável de Texto para Música
394 · diffusion-models
partilhatext-to-audiodiffusion-models
FoleyCrafter
[IJCV 2026] FoleyCrafter: Dê vida a vídeos silenciosos com sons realistas e sincronizados. AI拟音…
658 · aigc
partilhavideo-to-audiodiffusion-models
MM-Diffusion
[CVPR'23] MM-Diffusion: Aprendendo Modelos de Difusão Multimodal para Geração Conjunta de Áudio…
453 · audio-generation
partilhaaudio-generationdiffusion-models
LocalAI
LocalAI é o motor de IA de código aberto. Execute qualquer modelo - LLMs, visão, voz, imagem, v…
48k · agents
CosyVoice
Modelo de geração de voz grande multilíngue, fornecendo capacidade completa de inferência, trei…
22.5k · audio-generation
Amphion
Amphion (/æmˈfaɪən/) é um kit de ferramentas para Geração de Áudio, Música e Fala. Seu objetivo…
10k · audio-generation

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.