PulseAugur
实时 11:03:17
实体 Self-Paced Reinforcement Learning

Self-Paced Reinforcement Learning

PulseAugur coverage of Self-Paced Reinforcement Learning — every cluster mentioning Self-Paced Reinforcement Learning across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_193880 ·

    新的课程生成框架增强了自主代理导航策略

    研究人员开发了一个新的框架,用于在结构化参数化环境中生成课程,以增强自主代理导航策略的鲁棒性。该方法使用单向基于梯度的优化,并结合了分布偏移正则化目标,以提高跨多模态观测空间的泛化能力。在OpenAI Gym环境(特别是赛车变体和双足步行者)中的评估表明,该方法在性能上始终优于多种基线方法,包括标准策略训练、随机参数采样、手动课程以及其他先进技术,如自步强化学习和ALP-GMM。