研究人员开发了一种新的方法来标注自动语音识别(ASR)生成的古兰经背诵转录中的错误。此标注过程区分了实际错误、重复以及可接受的拼写变体。开发的评估器对这些标签及其位置进行评分,使用普通差异(plain diff)实现了 0.525 的标签感知 F1 分数和 0.826 的定位 F1 分数。对六个编码代理和八个模型的初步测试显示性能各异,大多数模型优于基线方法,突显了在 ASR 评估中约定和规范化的重要性。 AI
影响 这项研究可能有助于更准确地评估特定领域(如宗教文本背诵)的 ASR 系统。
排序理由 该集群包含一篇学术论文,详细介绍了一种用于 ASR 转录的新标注方法。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →