一项发表在arXiv上的新研究调查了专门针对粤语训练的语言模型,与针对标准中文或通用模型训练的模型相比,是否能更好地预测人类阅读模式。研究人员使用了粤语使用者的眼动追踪数据,并从不同的语言模型中提取了各种语言学指标。研究结果表明,经过更广泛粤语特定训练的模型,如CantoneseLLM-7B,在预测上与人类阅读行为的对齐度更强,尽管所使用的具体指标会影响模型排名。 AI
影响 这项研究可能为资源匮乏语言的更具语言学准确性的AI模型开发提供信息。
排序理由 该集群包含一篇详细介绍语言模型新评估的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →