一项发表在arXiv上的新研究调查了大型语言模型(LLMs)判断社交吸引力的能力。研究人员根据心理和关系建构构建了人物档案,将其分为社交吸引、混合和不吸引三个等级。在两项研究中,34个LLMs一致地对这些档案进行了评分,显示出跨运行的稳定性和相对排序的高度一致性,尽管在第三项研究中,它们比人类参与者更倾向于对有吸引力的档案给出更积极的评价,对不吸引人的档案给出更消极的评价。LLMs在评分中未显示与性别呈现相关的显著影响。 AI
影响 与人类相比,LLMs在判断社交吸引力方面表现出一致但可能更极化的能力,这引发了对其在主观评估中使用的疑问。
排序理由 该集群包含一篇详细介绍LLM能力研究结果的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →