MOSS-TTSD é um modelo de geração de diálogo falado projetado para síntese expressiva de múltiplos falantes. Ele apresenta modelagem de longo contexto, controle flexível de falantes e suporte multilíngue, permitindo clonagem de voz zero-shot a partir de referências de áudio curtas.
Gere diálogos falados expressivos a partir de texto, suportando múltiplos falantes e idiomas.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserMOSS-TTSD é um modelo de geração de diálogo falado projetado para síntese expressiva de múltiplos falantes. Ele apresenta modelagem de longo contexto, controle flexível de falantes e suporte multilíngue, permitindo clonagem de voz zero-shot a partir de referências de áudio curtas.
MOSS-TTSD tem 1.4k estrelas no GitHub. Foi bifurcado 134 vezes. MOSS-TTSD é escrito principalmente em Python. Está em desenvolvimento ativo desde 2025. MOSS-TTSD está disponível sob a licença Apache-2.0. Os seus principais temas são: finetune, large-language-models, sglang, speech-dialogue-generation.
MOSS-TTSD é um modelo de geração de diálogo falado projetado para síntese expressiva de múltiplos falantes. Ele apresenta modelagem de longo contexto, controle flexível de falantes e suporte multilíngue, permitindo clonagem de voz zero-shot a partir de referências de áudio curtas.
MOSS-TTSD é um projeto de código aberto. É distribuído sob a licença Apache-2.0.
Sim. MOSS-TTSD é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
MOSS-TTSD está disponível sob a licença Apache-2.0.
MOSS-TTSD é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://olud.ai/project/openmoss-moss-ttsd.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.