一项发表在 arXiv 上的新研究调查了大型语言模型(LLMs)是否拥有心智理论(ToM),即理解他人信念、意图和情感的能力。研究人员使用改编的“奇怪故事”范式,将包括 GPT-4o 在内的五个大模型与人类对照组进行了性能比较。虽然较小的模型显示出局限性,但 GPT-4o 在推断角色状态方面表现出了与人类相当的准确性和鲁棒性,引发了关于大模型理解的本质与复杂模式匹配之间关系的疑问。 AI
影响 这项研究深入探讨了大模型的理解深度,可能影响我们如何开发和解读人工智能的社会认知能力。
排序理由 该集群包含一篇发表在 arXiv 上的学术论文,评估了大模型的能力。[lever_c_demoted from research: ic=1 ai=1.0]
- Anna Babarczy
- arXiv
- DagsHub
- GPT-4o
- Hugging Face
- large-language models
- Strange Stories Paradigm
- Theory of Mind
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →