一篇新发表在arXiv上的论文指出了自动化翻译质量评估(QE)系统存在的显著局限性。研究认为,由于根本性的理论和经验问题,当前的QE工具在实际翻译工作流程中不能单独使用,其可靠性不足。这些局限性包括未能捕捉到连贯性、一致性和风格特征,以及泛化、偏见、过拟合和数据稀缺性等方面的问题,这些问题并未因数据或架构的进步而得到克服。 AI
影响 自动化翻译质量评估系统可能需要重新评估其在生产环境中的使用,这可能会增加对人工评估者的依赖。
排序理由 学术论文,讨论特定技术的局限性。[lever_c_demoted from research: ic=1 ai=0.7]
- alphaXiv
- arXiv
- CatalyzeX
- Connected Papers
- DagsHub
- Gotit.pub
- Hugging Face
- Litmaps
- ScienceCast
- scite Smart Citations
- South Marquesan
- translation quality estimation
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →