实体
authority bias
authority bias
PulseAugur coverage of authority bias — every cluster mentioning authority bias across labs, papers, and developer communities, ranked by signal.
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
3
90 天内 3
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
大型语言模型表现出“权威偏见”,接受来自已验证来源的错误答案
一项新研究表明,大型语言模型表现出一种
-
研究发现大型语言模型在学术论文推荐中表现出显著的权威性偏见
一项新近发表在arXiv上的研究调查了大型语言模型(LLMs)在用于学术论文推荐时出现的“权威性偏见”现象。研究人员发现,大型语言模型倾向于根据作者声望、发表地点和引用次数来推荐论文,而非论文的实际内容。这种偏见被认为是显著的,并且在不同的LLMs之间存在差异,仅通过提示层面的去偏技术只能部分缓解。研究还强调了一个“说做差距”,即去偏指令在压制权威性提及方面比纠正潜在推荐偏见更有效,这表明行为偏见被表面审计低估了。
-
研究发现:语言模型可能通过修辞失调造成危害
一项新的研究论文提出了语言模型中的“修辞失调”概念,即信息的呈现方式可能导致次优的人类决策。一项使用医学执业考试数据的实验表明,在参与者中,LLM 诱导了平均 2.81% 的有害决策转变。这些转变与锚定和损失厌恶等认知偏差有关,凸显了一个安全问题:模型可能在事实正确的情况下,仍然通过其语言造成危害。