研究人员进行了一项预指定的构造确认测试,以研究在冻结的Qwen2.5-7B-Instruct模型中符号域内的因果迁移。研究聚焦于特定路径“integer_mod16--letters16--successor->predecessor”,该路径通过了两个PyVene分割,确认交并集p值为0.000198。随后的NNsight实验在数值上复制了这些发现,确认了效应估计值和p值。 AI
影响 这项研究提供了一种测试符号域中因果迁移的方法,有望提高LLM行为的可解释性和理解度。
排序理由 该集群包含一篇学术论文,详细介绍了模型能力的一项具体研究发现。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →