研究人员调查了大型语言模型(LLMs)如何处理复数指代,特别是它们如何表征和检索单数与复数实体。该研究利用机制可解释性和注意力模式分析,识别出负责共指信息的特定注意力头,识别复数指代,并预测代词。研究结果表明,大型语言模型在复数代词方面与人类偏好一致,尤其是在实体本体上相似并通过“和”连接时。 AI
影响 为共指消解中的大型语言模型推理能力提供了见解,可能提高其对复杂语言结构的理解。
排序理由 该集群包含一篇详细介绍大型语言模型机制研究的论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- Coreference Resolution
- CORE Recommender
- DagsHub
- Gotit.pub
- Hugging Face
- LLMs
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →