PulseAugur
实时 09:17:01
实体 Nonstationary Reinforcement Learning

Nonstationary Reinforcement Learning

PulseAugur coverage of Nonstationary Reinforcement Learning — every cluster mentioning Nonstationary Reinforcement Learning across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_165061 ·

    新的强化学习安全框架适应变化的环境

    研究人员为在非平稳环境中运行的强化学习系统引入了一个新的安全约束。该框架称为“调整速度”,侧重于智能体在关键恢复范围内适应预测环境变化的能力。通过将适应需求与智能体的校准恢复能力进行估计,系统可以在违规发生之前主动调整其允许的动作集并部署保护措施,以减轻潜在的不安全行为。在模拟驾驶环境中进行的实验表明,这种方法能有效减少安全违规行为,尤其是在环境变化期间。