实体
Command And Data Processing
Command And Data Processing
PulseAugur coverage of Command And Data Processing — every cluster mentioning Command And Data Processing across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新的强化学习框架解决灾难性安全违规问题
研究人员推出了一种新的框架——鲁棒峰值成本约束强化学习(RP-CRL),该框架专为安全关键型应用设计,在这些应用中,单次成本违规可能导致灾难性后果。与现有方法不同,RP-CRL解决了峰值成本约束马尔可夫决策过程中可能存在的零对偶间隙缺失问题,并采用鲁棒公式来处理模拟与现实世界动力学之间的差异。所提出的解决方案利用了代理优化框架和积分概率度量来进行鲁棒价值估计,即使在动态扰动下也能有效执行安全策略并获得良好的奖励性能。
-
Dynamic-TD3算法通过障碍物轨迹预测增强无人机路径规划
研究人员开发了Dynamic-TD3,这是一种旨在改善无人机(UAV)在具有动态障碍物环境中路径规划的新型算法。该框架通过将导航建模为约束马尔可夫决策过程(CMDP)来解决深度强化学习中的安全探索困境。它结合了用于预测远程意图的自适应轨迹关系演化机制(ATREM)和用于处理传感器噪声的物理感知门控卡尔曼滤波器(PAG-KF),最终提高了避碰能力和效率。