一篇新发表在arXiv上的研究表明,为金融任务微调大型语言模型会显著增加数值幻觉。该研究引入了一个三级分类法来对数值捏造进行分类,发现领域自适应会严重损害数值约束。与预期相反,即使是增强了计算能力的模型也表现出更高的幻觉率,其中一个变体达到了98%的明显幻觉。研究将模板注入确定为这种幻觉的关键机制,并建议当前的评估方法需要包含所有可检测级别,并且部署应包括基于事实的生成。 AI
影响 为金融等专业领域微调LLM可能会带来显著的数值幻觉风险,需要更强大的评估和事实依据生成机制。
排序理由 发表在arXiv上的学术论文,详细介绍了关于LLM幻觉的研究。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →