PulseAugur
实时 07:09:29
实体 Chuang et al. 2023

Chuang et al. 2023

PulseAugur coverage of Chuang et al. 2023 — every cluster mentioning Chuang et al. 2023 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_113318 ·

    新指标衡量LLM代理社会共识的有效性

    研究人员开发了一种新指标——耦合增益(gamma),用于评估LLM代理社会中涌现共识或极化的有效性。通过扰动代理观点的这种指标,在不同的前沿模型中表现稳定,并能区分真实的社会动态和模型伪影。研究发现,LLM社会不会自发地自我极化,这表明极化总是被诱导的。一种基于初始与最终观点的诊断工具可以将真实的平均化与模型先验伪影分离开来,揭示先前发表的“涌现共识”结果可能混淆了这两种现象。

  2. RESEARCH · CL_104633 ·

    LLM 代理社会展现出涌现秩序和共识挑战 · 跟踪 3 个来源

    两篇新研究论文探讨了大型语言模型 (LLM) 代理在模拟社会中的行为。第一篇论文《LLM 代理社会中涌现的关系秩序》提出了一个名为 CAREB-MAS 的多代理框架,该框架可重现劳动专业化和权威分层等社会现象。第二篇论文《涌现共识何时真实?》介绍了一种测量协议和诊断工具,用于区分 LLM 代理社会中真实的社会动态和模型伪影,发现 LLM 不会自发地自我极化,并且共识可能是模型伪影。