PulseAugur
实时 08:34:36
实体 Cladder & Jansen

Cladder & Jansen

PulseAugur coverage of Cladder & Jansen — every cluster mentioning Cladder & Jansen across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_178414 ·

    在辛普森悖论场景下,干预数据未能教会语言模型因果方向

    一篇新的研究论文探讨了干预数据在教会语言模型因果推理方面的有效性。研究发现,在呈现辛普森悖论的场景中(即观察相关性和因果效应符号相反),在预训练期间增加干预样本并不能提高模型辨别因果方向的能力。相反,模型的推理时上下文极大地影响了其解释,纯粹的观察性上下文会导致系统性的符号反转。研究表明,虽然因果推理的能力存在于模型的权重中,但其激活受推理时上下文的控制,尤其是在中间层。

  2. RESEARCH · CL_50625 ·

    LLM内部编码因果推理能力,但无法口头表达

    一篇题为“因果语言障碍”(Causal Tongue-Tie)的新研究论文指出,大型语言模型(LLMs)在因果推理方面的内部编码与其实际输出之间存在差异。研究发现,虽然LLMs可以在其隐藏状态中准确表示因果方向(通过线性探测达到约0.97的准确率),但它们直接的是/否回答常常回归常识,准确率仅为约0.5。这种“因果语言障碍”表明,LLM的输出可能无法完全反映其内部理解,这使得评估其因果推理能力变得复杂。