一篇新研究论文探讨了大型语言模型(LLMs)如何处理指代消解,这是一项语言任务,其中一个词或短语指代另一个词。该研究使用模仿人类认知过程的方法测试了五种开源LLMs——GPT-2 XL、Llama-3.1:8b、Pythia-12B、Mistral:7b 和 Mistral 24B——例如测量模型的“意外度”来近似阅读时间,并将模型的准确性与人类理解力进行比较。研究结果表明,一些LLMs在消解指代时表现出对语篇突出度和距离等因素的类似人类的敏感性,但在语义干扰效应方面表现不那么一致。 AI
影响 这项研究为LLMs的语言能力提供了见解,可能指导未来模型开发,以实现更像人类的语言理解。
排序理由 在arXiv上发表的研究论文,详细介绍了LLM的能力。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →