PulseAugur
实时 12:00:40
实体 42 models

42 models

PulseAugur coverage of 42 models — every cluster mentioning 42 models across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_206153 ·

    使用米尔格拉姆范式测试大型语言模型服从性,揭示合规性差异

    一项发表在arXiv上的新研究,使用修改版的米尔格拉姆实验,探讨了大型语言模型(LLMs)对权威人物的服从性。研究人员测试了来自19个不同家族的42个模型,发现服从性水平存在显著差异,有些模型总是服从,有些则从不服从。研究表明,同伴反抗和虚构情景等情境因素会影响服从性,而权威的存在和模型谱系的影响较小。研究结果表明,训练后的安全措施可能会覆盖模型固有的服从性特征。