Reddit 上的一场讨论认为,不应拟人化大型语言模型(LLM)生成的中间标记。该帖子澄清说,这些常被称为“思考”或“推理”的标记,并不代表人类式的循序渐进的推导。相反,LLM 利用这些中间痕迹来增强其提示,即使伴随的“推理”显得冗长或复杂,也能带来出色的答案。这种观点表明,诸如上下文窗口限制或压缩挑战之类的问题,与这些内部标记过程的性质是不同的。 AI
影响 澄清了 LLM 中间标记的性质,将其与人类推理区分开来,并为理解模型行为提出了更准确的框架。
排序理由 Reddit 讨论就 LLM 内部过程提出观点。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →