研究人员通过微调OpenAI的Whisper模型,开发了一个新的缅甸语医学语音识别框架。他们创建了一个包含28小时缅甸语医学语音的语料库,并由母语者进行了验证,同时使用了全参数微调和LoRA等参数高效技术。数据增强在嘈杂条件下提高了鲁棒性,表现最佳的系统myMediWhisper-Medium实现了最先进的23.44%词错误率。 AI
影响 提高了资源匮乏语言中专业医学对话的自动语音识别性能。
排序理由 该条目描述了一篇研究论文,详细介绍了针对特定领域和语言对现有模型进行微调。 [lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Daily Papers 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →