用合成语音构建和评估固定音色泰语 TTS:Wayu-Paxa-TTS-Edge 开源
Building and Evaluating Fixed-Voice Thai TTS from Synthetic Speech
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究者提出用大型语音克隆模型作为可编程数据源,将 15 秒语音参考转化为完全基于合成语音训练的紧凑固定音色学生模型,并开源 82M 参数的泰语 TTS 模型 Wayu-Paxa-TTS-Edge,支持无参考音频的端侧泰语合成。
来源:Hugging Face Daily Papers · arxiv.org