研究人员开发了 DriftTTS,这是一种新颖的少样本文本到语音模型,无需依赖预训练教师模型蒸馏或对抗性判别即可实现具有竞争力的合成质量。该模型在梅尔域特征空间中利用分布匹配漂移目标,并使用 on-policy rollout 进行训练。在 LJSpeech 数据集上,DriftTTS 在 MCD 和 WER 方面表现出色,并且在盲听测试中,其 MOS 分数可与真实数据媲美,优于 Matcha-TTS。 AI
影响 这项研究为少样本 TTS 合成提供了一种新方法,有望降低计算需求和训练复杂性。
排序理由 该集群包含一篇详细介绍新模型发布的论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →