Kushal Chakrabarti 的一篇新研究论文强调了一个大型语言模型中令人担忧的趋势:随着模型规模的扩大,它们生成正确答案的能力下降速度比之前理解的要快。这种被称为“自回归风险机制”的现象发生在模型承诺低概率标记并将其错误滚雪球般地变成捏造时。研究表明,虽然模型的整体能力有所提高,但其可靠性却显著下降,检测方法通常无法识别这些自信但错误的输出。 AI
影响 表明当前的缩放方法可能会固有地降低可靠性,需要新的方法来检测和减轻模型的捏造。
排序理由 学术论文,详细介绍了关于 LLM 行为的新发现。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →