研究人员开发了一种名为顺序适配器堆叠的新方法,以改进低资源语言的自动语音识别(ASR)。该技术涉及将可训练的目标语言适配器叠加在冻结的源语言适配器之上,并基于现有的多语言 ASR 模型(如 Whisper)。实验表明,即使对于阿斯图里亚斯语、阿萨姆语和科萨语等语言,仅用一小时的训练数据,该方法也显著优于完全微调,相对词错误率降低了 5-8%。 AI
影响 这项研究可能显著提高 ASR 技术对代表性不足的语言的可访问性和可用性。
排序理由 该集群包含一篇详细介绍 ASR 新方法的论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →