研究人员开发了EviSI,一种旨在评估同声语音到语音翻译系统的新评估代理。与BLEU和COMET等传统指标不同,EviSI采用了多维度质量指标(MQM)原则,以更好地评估可能重新组织或总结源内容以实现及时交付的系统。EviSI构建共享源证据,评估语义保真度和口语表达,并协调错误以提供确定性分数。该代理已证明与人工排名在英语到中文翻译方面高度一致,并与其他语言对的COMET显示出积极的一致性。 AI
影响 为同声传译引入了更强大的评估方法,可能改进未来语音到语音AI系统的开发和评估。
排序理由 该项目描述了一种用于语音到语音翻译系统的新评估代理,该代理在一篇研究论文中提出。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Daily Papers 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →