PulseAugur
实时 07:08:58
实体 Planning Diffusion Policy Optimization

Planning Diffusion Policy Optimization

PulseAugur coverage of Planning Diffusion Policy Optimization — every cluster mentioning Planning Diffusion Policy Optimization across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_223292 ·

    新的PDPO框架通过扩散策略增强机器人人群导航

    研究人员推出了一种新颖的强化学习框架——规划扩散策略优化(PDPO),用于机器人人群导航。PDPO利用扩散策略生成短视界动作序列,与输出单一反应性动作的传统方法相比,能够实现更多样化和更高效的决策。该框架在避碰演示上进行预训练,然后使用近端策略优化(PPO)进行在线微调。为了解决现有基准测试中的评估伪影,PDPO纳入了边界约束,将违规视为碰撞,从而提高了在修改后的有界基准测试上的性能。