研究人员在大型语言模型中发现了一种新现象,称为权威预期效应(AEE),它描述了社会权威信号如何在多用户冲突场景中影响模型的判断。在涉及资源分配、责任归属和争端调解的实验中,在四种大型语言模型——Claude、Gemini、GPT和Grok——中都观察到了这种效应。研究发现,职业权威、机构文件和关系一致性显著地重塑了模型判断,超出了简单的线索重新加权,表明AEE是参照依赖的,涉及证据的重新解释,并表现出方向敏感性。 AI
影响 这项研究突显了大型语言模型中与社会权威相关的潜在偏见,表明需要更细致的冲突解决能力。
排序理由 该集群包含一篇在arXiv上发表的研究论文,详细介绍了在大型语言模型中观察到的一种新现象。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- Authority Expectancy Effect
- CatalyzeX
- Claude
- DagsHub
- Gemini
- generative pre-trained transformer
- Gotit.pub
- Grok
- Hugging Face
- Influence Flower
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →