研究人员推出了一种名为谱正交探索 (SOE) 的新框架,旨在解决大型语言模型在复杂数学任务中出现的“推理崩溃”问题。SOE 在“学生指导教师”范式下运行,其中较弱的模型不模仿,而是探测教师模型在其主导推理子空间的正交方向。这种干预鼓励更多样化的推理轨迹,从而在数学基准测试中显著提高准确性和采样效率。初步结果还表明 SOE 在逻辑和代码生成任务中也有效。 AI
影响 缓解了大型语言模型的推理崩溃问题,有可能提高在数学和代码生成等复杂任务上的性能。
排序理由 学术论文,详细介绍了一种改进大型语言模型推理的新方法。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →