研究人员开发了一种新颖的方法,使大型语言模型能够在不要求标记数据集的情况下,识别并避免回答它们不确定的问题。这种无标签的方法利用了模型内部的置信度信号,当模型生成错误信息时,这些信号往往会减弱。通过对模型进行微调,使其在置信度低时弃权,该方法在各种开源模型上的表现与传统的监督弃权微调技术相当。这项技术为教会模型何时承认不确定性提供了一种几乎免费的替代昂贵标记数据集的方法。 AI
影响 这项研究通过使模型能够自我识别并避免回答不确定的查询,为提高大型语言模型的可靠性提供了一种经济高效的方式。
排序理由 该项目是一篇学术论文,详细介绍了一种用于大型语言模型的新方法。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- DagsHub
- Gotit.pub
- Hugging Face
- judge model
- large-language models
- LoRA+
- open-weights models
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →