一篇新的研究论文探讨了大型语言模型 (LLM) 所编码的信息与其利用这些信息的能力之间的差距,特别是在几何推理领域。研究发现,虽然 LLM 在预训练后可以有效地解码局部几何关系,但关于草图级约束的信息已经可以从随机初始化的表示中高度解码。此外,研究表明,可解码的信息并不总是能转化为可行的行为,因为生成通常无法表达这些信息,并且干预方法也无法可靠地控制输出。这种分歧突显了编码与表达或控制编码几何结构之间存在的不同失败。 AI
影响 强调了 LLM 推理和行动能力的局限性,表明当前模型可能无法充分利用编码的知识来完成复杂任务。
排序理由 关于 LLM 能力的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →