PulseAugur
实时 09:23:21
English(EN) The Authority Expectancy Effect in Multi-User Conflict

在Claude和Gemini等大型语言模型中发现新的“权威预期效应”

研究人员在大型语言模型中发现了一种新现象,称为权威预期效应(AEE),它描述了社会权威信号如何在多用户冲突场景中影响模型的判断。在涉及资源分配、责任归属和争端调解的实验中,在四种大型语言模型——ClaudeGemini、GPT和Grok——中都观察到了这种效应。研究发现,职业权威、机构文件和关系一致性显著地重塑了模型判断,超出了简单的线索重新加权,表明AEE是参照依赖的,涉及证据的重新解释,并表现出方向敏感性。 AI

影响 这项研究突显了大型语言模型中与社会权威相关的潜在偏见,表明需要更细致的冲突解决能力。

排序理由 该集群包含一篇在arXiv上发表的研究论文,详细介绍了在大型语言模型中观察到的一种新现象。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

在Claude和Gemini等大型语言模型中发现新的“权威预期效应”

报道来源 [1]

  1. arXiv cs.AI TIER_1 English(EN) · Eunna Lee ·

    多用户冲突中的权威期望效应

    arXiv:2608.08026v1 Announce Type: new Abstract: We investigate how social authority (SA) signals interact with severity-based prioritization in large language models, operationalizing each axis as a model-elicited baseline -- the triage hierarchy and the SA hierarchy. Across four…