PulseAugur
实时 07:40:34

论文认为惊奇度理论并非与表征无关

一篇新论文认为,惊奇度理论(Surprisal Theory),通常被视为一种计算层面的解释,实际上并非与表征无关,尤其是在大型语言模型(LLMs)的背景下。作者认为,不加批判地使用 LLM 惊奇度指标会掩盖不同模型所做的底层表征和算法选择。通过三项分析,该论文表明算法和模型架构显著影响语言模型的概率,并敦促研究人员在测试惊奇度理论时重新考虑将 LLM 概率视为可互换的。 AI

影响 挑战了使用 LLM 概率进行研究的理论基础,可能影响语言模型能力的评估方式。

排序理由 一篇在 arXiv 上发表的关于语言模型理论方面的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CL 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

论文认为惊奇度理论并非与表征无关

报道来源 [1]

  1. arXiv cs.CL TIER_1 English(EN) · Andr\'es Bux\'o-Lugo, Aniello De Santo, Morgan Grobol, Ryan J. Hubbard, Cassandra L. Jacobs ·

    surprisal is Not a Theory

    arXiv:2607.20208v1 Announce Type: new Abstract: Surprisal Theory is often characterized as a computational-level explanation per (Marr, 1982). We argue in this work that, even though a computational level narrative has been used to support "representation-agnostic research" withi…