研究人员开发了一种称为知识对齐SFT的方法,以减少语言模型中的事实幻觉。该方法将训练目标限制在模型现有的参数知识范围内,这与可能使用外部知识的标准SFT形成对比。引入了新的变体Evidence Rewrite和Recall Rewrite,并在Qwen 3 4B和OLMo 3 7B等模型上进行了测试。结果表明,知识对齐SFT可以提高事实准确性并保留通用能力,其中Recall Rewrite在事实准确性和拒绝行为方面显示出最显著的提升。 AI
影响 这项研究通过改进微调过程,有可能带来更具事实准确性的语言模型。
排序理由 该集群包含一篇研究论文,详细介绍了语言模型监督微调的新方法。[lever_c_demoted from research: ic=1 ai=1.0]
- Biography
- Evidence Rewrite
- knowledge-aligned SFT
- language model
- OLMo 3 7B
- Qwen 3 4B
- Recall Rewrite
- Stick to What You Know: A Study of Knowledge-Aligned Supervised Fine-Tuning
- supervised fine-tuning
- UnknownBench
- WildHalu
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →