研究人员开发了一种新颖的多方言神经机器翻译系统,旨在解决孟加拉语方言差异带来的重大挑战。该系统可以在12种地区孟加拉语方言之间进行翻译,而无需中间标准语言。经过微调的BanglaT5模型利用权重分解低秩适配(DoRA),取得了最先进的性能,优于NLLB-200和mBART-50等大型模型。该项目还汇编了迄今为止最大的孟加拉语多方言平行语料库,并发布了一个优化的模型开放访问的Web应用程序,以促进数字包容性。 AI
影响 增强了低资源语言和地区方言的NLP能力,促进了数字包容性。
排序理由 详细介绍新的NLP系统和数据集的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- Bangla
- BanglaT5
- Hugging Face
- mBART-50
- Mendeley Data
- NLLB-200
- Poly-Dialectal Neural Machine Translation System
- Standard Colloquial Bangla (SCB)
- Weight-Decomposed Low-Rank Adaptation (DoRA)
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →