arXiv上发表的一项新研究表明,化学推理语言模型尽管有望通过链式思考(CoT)推理提供准确的分子答案,但却频繁出现广泛的幻觉。这种结构性声明的虚构往往与最终答案的正确性脱钩。研究表明,CoT充当了一个“易产生幻觉的分子草稿板”,其中Chem-R和ether-0等模型使用零散的SMILES草稿,而ChemDFM-R则强调骨架和命名线索。对Chem-R中的这些结构草稿的扰动表明了对生成的因果影响,这表明即使在语言声明不准确的情况下,这些内部分子表示也是有支撑作用的。 AI
影响 强调了化学模型中链式思考推理的不可靠性,警告不要直接将CoT解释为忠实的推理,并推动过程级监督。
排序理由 学术论文,详细介绍了语言模型推理过程的发现。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →