一项对四种大型语言模型——Mistral Large、Llama 3.3 70B Instruct、GPT-OSS 120B 和 Claude Sonnet 4.6——进行的审计新研究发现,当被要求从特定目录推荐项目时,这些模型普遍表现出信心不足。尽管之前的研究侧重于幻觉方面的过度自信,但此次审计发现,即使模型没有产生幻觉,它们表达的信心也常常低于其实际准确性所暗示的水平。研究表明,这种信心不足源于提示词引发置信度评分的方式不匹配,而不是对目录成员资格缺乏真正的确定性。 AI
影响 强调了大型语言模型表达信心方面可能存在的错配,表明当前方法可能无法准确反映它们对特定目录推荐的理解。
排序理由 学术论文,详细介绍了对大型语言模型置信度校准的审计。
在 arXiv cs.IR (Information Retrieval) 阅读 →
- Amazon Reviews 2023 Toys
- Claude Sonnet 4.6
- GPT-OSS 120B
- Llama 3.3 70B Instruct
- Mistral Large
- MovieLens-25M
- Yelp Open Dataset
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →