实体
Latent CoT
Latent CoT
PulseAugur coverage of Latent CoT — every cluster mentioning Latent CoT across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
研究深入探讨具有潜在思维链推理的LLM可监测性
一篇新的研究论文探讨了在使用思维链(CoT)推理时大型语言模型(LLMs)的可监测性,特别关注了通过用连续状态替换显式推理痕迹来降低推理成本的潜在CoT方法。该研究通过在数学推理和问答任务上比较显式CoT与弱监督和强监督潜在CoT,研究了这些潜在CoT方法在监测特定行为(如依赖于输入提示的偏见)方面的有效性。研究结果表明,可监测性更多地受到任务特性和模型内部访问级别的影响,而不是所采用的具体推理模式。
-
新研究质疑语言模型中的叠加现象
一篇新论文分析了语言模型中“叠加”现象,即多个解决方案可能同时存在于单个表示中。研究人员使用三种不同的训练模式进行了调查:无训练、微调和从头开始训练。他们的发现表明,只有完全从头开始训练的模型才表现出利用叠加的迹象。相比之下,在无训练和微调模式下的模型要么崩溃了叠加,要么没有使用它,而是选择了捷径解决方案。