研究人员推出了一种名为Twin Worlds (TW) 的新颖框架,旨在提高大型语言模型 (LLM) 在知识密集型推理任务中的可靠性。TW通过关注证据基础来解决LLM生成不支持的答案的问题。该框架利用了等变性(一种输出在实体替换时可预测地转换但保留关系结构),来检测推理何时没有可靠地基于提供的证据。跨多个基准和模型骨干的实验表明,TW能有效识别未基于证据的答案,性能优于现有的弃权方法。 AI
影响 引入了一种新方法来提高LLM在基于证据的推理中的可靠性,可能减少幻觉。
排序理由 详细介绍LLM推理新框架的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →