研究人员开发了专门针对低资源语种的新语音强制对齐模型,重点关注成都话。他们使用了一个17小时的语料库,训练了一个文本相关的GMM-HMM模型Chengdu-MFA和一个文本无关的模型Chengdu-FC。与标准普通话基线相比,这两个模型都取得了显著的改进,Chengdu-MFA将电话边界差异减少了31.8%,Chengdu-FC实现了61.2%的减少,并建立了一个无需大量手动标注即可开发对齐器的流程。 AI
影响 为开发资源匮乏语种的准确语音对齐器建立了一个实用的流程。
排序理由 该集群包含一篇学术论文,详细介绍了针对特定语种的新模型训练和评估。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →