研究人员开发了一个名为TACLO(Trajectory-Level Automatic Curriculum Learning)的新框架,以改进用于在非结构化地形上导航的机器人的训练。TACLO直接从地形图中生成训练任务,使用评估器学习当前策略的难度函数,并使用采样器提出新的轨迹。这个迭代过程不断地使课程与不断发展的策略相匹配,与没有课程的直接训练相比,轨迹成功率提高了56.3%。该框架的表现也优于手工制作的课程学习方法,在困难地形任务上的成功率提高了18.5%,在从不同接近方向评估时提高了39.74%。 AI
影响 这项研究可能带来更强大、更适应复杂现实世界环境的机器人。
排序理由 该集群包含一篇详细介绍机器人运动新框架的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →