实体
optimal control
optimal control
PulseAugur coverage of optimal control — every cluster mentioning optimal control across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 3
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
-
新研究通过随机最大值原理构建伴随匹配
一篇题为“Adjoint Matching through the Lens of the Stochastic Maximum Principle in Optimal Control”的新研究论文,由Jiequn Han撰写,严格推导并推广了随机最优控制问题的伴随匹配方法。该工作构建了一个哈密顿伴随匹配目标,并证明了其与Hamilton-Jacobi-Bellman平稳性条件的关系。对于扩散项与状态和控制无关的情况,该论文恢复了先…
-
新框架整合逆向优化用于分层决策
研究人员开发了一个新颖的分层决策框架,该框架将上层目标抽象与结构化的底层决策相结合。该方法利用逆向优化,通过专家演示获得见解,使底层策略的目标与整体长期任务目标保持一致。该框架在网络资源分配和连续避碰等任务上进行了评估,与现有的分层强化学习和学习增强最优控制方法相比,在效率和决策质量方面均表现更优。
-
受神经启发的逆向框架增强了AI规划与控制
研究人员开发了一个新颖的、受神经启发的框架,名为Inverter,用于具身规划与控制。该框架利用逆向学习(IL)来训练组件,通过对整个动作序列进行规划,弥合了强化学习与最优控制之间的差距。Inverter在各种基准任务上展示了比现有方法显著的性能提升,在推理过程中以显著更低的计算成本取得了更好的结果。