三篇最新的学术论文探讨了生成式AI与语言多样性之间的复杂关系,特别关注世界英语。第一篇论文讨论了AI工具如何能够既促进学术写作的民主化,又可能边缘化少数英语变体,呼吁制定具有公平意识的政策和包容性的协同设计。第二篇论文考察了大型语言模型(LLMs)如何再生产占主导地位的语言意识形态,偏袒“内圈”规范,并可能对“外圈”英语用户构成挑战,同时也指出一个悖论:AI可能使英语趋于同质化,但又通过多样化的语料库使其多样化。第三篇论文评估了AI在约鲁巴语、基尼亚卢旺达语和阿姆哈拉语等非洲语言上的表现,发现虽然模型在经过精心策划的新闻数据上表现出色,但在处理Reddit等平台上的代码转换会话数据时却遇到困难,这凸显了需要能够处理干净和混合语言文本的模型。 AI
影响 这些论文强调了AI开发中关于语言公平的关键问题,以及AI可能加剧或挑战现有语言等级制度的潜力,敦促进行更具包容性的设计。
排序理由 该集群包含三篇在arXiv上发表的学术论文,讨论了AI对语言多样性的影响。
- Amharic
- English
- generative artificial intelligence
- GlotLID
- Hugging Face
- Kinyarwanda
- large-language models
- linguistic diversity
- linguistic inclusivity
- Llama 3.3-70B
- World Englishes
- Yoruba
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →