实体
Shiyu Ni
Shiyu Ni
PulseAugur coverage of Shiyu Ni — every cluster mentioning Shiyu Ni across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新研究发现:LLM过度自信与知识流行度相关
一篇新的研究论文探讨了大型语言模型(LLM)在错误答案上表现出高度自信的现象,这个问题被称为过度自信。该研究着眼于知识流行度,发现幻觉答案通常比正确答案更受欢迎,或与问题实体有更频繁的关联。此外,即使答案是错误的,LLM也倾向于为更受欢迎的答案分配更高的置信度。研究提出,纳入知识流行度信号可以显著缓解这种过度自信,降低错误答案的平均置信度,并提高整体置信度估计。
-
长推理链影响LLM对答案事实性的判断
一篇新的研究论文探讨了大型语言模型(LLM)如何判断答案的事实性,特别是在呈现推理链时。研究发现,虽然一些LLM可以利用推理作为证据,但它们常常被流畅但错误的推理所误导。研究强调,推理链的流畅性和事实性都会显著影响LLM的判断,这表明需要更强大的LLM判断器来辨别真实的推理质量。