PulseAugur
实时 17:38:48
实体 navigation environments

navigation environments

PulseAugur coverage of navigation environments — every cluster mentioning navigation environments across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_154059 ·

    新的强化学习方法教会 AI 代理何时规划或反应

    研究人员开发了一种新的强化学习方法来训练人工智能代理进行元推理,使其能够决定是进行快速的反应式决策还是缓慢的审议式规划。该方法使用一种元推理策略,预测反应式策略何时可能表现不佳,从而发出信号表明需要通过规划进行更多计算。在运动规划和导航环境中的实验表明,该系统可以有效地学习何时进行规划,而不是依赖于反应式策略,并且它能够适应以提高反应式策略的性能。