实体
Goofspiel
Goofspiel
PulseAugur coverage of Goofspiel — every cluster mentioning Goofspiel across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新的 LUGL 框架使梯度提升树能够用于强化学习游戏
研究人员开发了一个名为 LUGL(本地更新,全局学习)的新框架,该框架允许将非增量学习器(如梯度提升树,GBT)有效地用于强化学习(RL)环境。这种方法将数据收集与模型拟合分离开来,使 GBT 能够克服通常阻碍其在 RL 中使用的分布偏移问题。LUGL 在有限表格中累积表格更新与使用该表格训练可泛化函数逼近器之间交替进行。在各种完全信息和不完全信息游戏中的实验表明,LUGL(特别是使用 LightGBM 时)的性能与 DQN 和 De…
-
人工智能责任的形式化模型与人类判断的比较
研究人员借鉴因果归因框架,开发了多主体人工智能系统中责任归属的形式化模型。他们进行了一项大规模调查,使用修改版的Goofspiel纸牌游戏,将这些形式化模型与人类在顺序决策场景中的责任判断进行比较。虽然没有单一的形式化方法能完全匹配人类的直觉,但该研究确定了影响人类责任感知的关键因素,例如特定于代理的偏见以及代理可获得的信息。