MOSS-TTSD è un modello di generazione di dialoghi parlati progettato per una sintesi multi-parlante espressiva. Presenta modellazione a lungo contesto, controllo flessibile degli oratori e supporto multilingue, consentendo la clonazione vocale zero-shot da brevi riferimenti audio.
Genera dialoghi espressivi parlati da testo, supportando più relatori e lingue.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiMOSS-TTSD è un modello di generazione di dialoghi parlati progettato per una sintesi multi-parlante espressiva. Presenta modellazione a lungo contesto, controllo flessibile degli oratori e supporto multilingue, consentendo la clonazione vocale zero-shot da brevi riferimenti audio.
MOSS-TTSD ha 1.4k stelle su GitHub. È stato forkato 134 volte. MOSS-TTSD è scritto principalmente in Python. È in sviluppo attivo dal 2025. MOSS-TTSD è disponibile con licenza Apache-2.0. I suoi temi principali sono: finetune, large-language-models, sglang, speech-dialogue-generation.
MOSS-TTSD è un modello di generazione di dialoghi parlati progettato per una sintesi multi-parlante espressiva. Presenta modellazione a lungo contesto, controllo flessibile degli oratori e supporto multilingue, consentendo la clonazione vocale zero-shot da brevi riferimenti audio.
MOSS-TTSD è un progetto open source. È rilasciato con licenza Apache-2.0.
Sì. MOSS-TTSD è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
MOSS-TTSD è disponibile con licenza Apache-2.0.
MOSS-TTSD è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://opensourceai.tech/project/openmoss-moss-ttsd.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.