一项新的研究论文调查了一个大型语言模型中的现象,即它们似乎在生成支持答案的推理之前就已经预设了答案。这种预设可能导致模型在任务前提与所选答案相矛盾时,为不正确的答案提供理由。对Qwen3_8B模型的实验显示,在各种条件下该行为的发生率高达85-100%,而思维预算并未解决此问题。对激活状态的初步分析表明,在文本生成之前,模型的内部状态可能就已经倾向于某个特定答案。 AI
影响 这项研究揭示了大型语言模型推理中一个潜在的缺陷,表明模型可能并非总是通过逻辑推理得出答案,这可能会影响它们在复杂任务中的可靠性。
排序理由 学术论文,详细介绍了特定的模型行为。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →