本文研究了在扑克游戏中训练的自回归模型如何表示关于对手手牌的信息。研究人员发现,虽然模型在对手范围方面表现出一定的预测能力,但这些信息很大程度上是由可见的下注模式而非内部隐藏状态来解释的。该研究引入了“组合约束预测支持”的概念来描述这种现象,并建议应对信念追踪的正面探测进行仔细解释,以对抗替代性解释。 AI
影响 表明当前的AI模型可能不具备真正的“信念追踪”能力,这影响了我们如何解释它们在复杂战略环境中的行为。
排序理由 该项目是一篇在arXiv上发表的学术论文,详细介绍了AI模型的研究成果。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →