研究人员开发了一种新颖的无批评者深度强化学习(DRL)框架,用于不规则六边形网格上的海上覆盖路径规划。该方法利用基于Transformer的指针策略来构建最优覆盖路线,克服了传统分解方法的局限性。该系统在合成环境中实现了99.1%的汉密尔顿成功率,在路径效率和航向改变方面优于启发式基线,并且推理时间适合实时船载部署。 AI
影响 这种无批评者DRL方法可以通过改进路径规划能力,实现更高效、更自主的海上作业。
排序理由 详细介绍AI新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- Carlos Sepúlveda
- DagsHub
- Group Relative Policy Optimization
- Hamiltonian operator
- Hugging Face
- ScienceCast
- Transformer++
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →