研究人员已成功将OpenAI的Whisper模型适配用于巴西、哥伦比亚和委内瑞拉使用的巴西原住民阿拉瓦坎语Baniwa的自动语音识别。研究使用了约0.54小时转录语音的小型语料库,对Whisper Small模型进行了微调。所得模型达到了37.5%的词错误率和7.45%的字符错误率,展示了大型多语言模型在极低资源语言方面的潜力。 AI
影响 展示了适配大型多语言模型用于原住民语言的可行性,可能为语言保护和技术普及开辟新途径。
排序理由 学术论文,详细介绍了预先存在的模型针对低资源语言的微调。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →