研究人员开发了一种新颖的风险规避强化学习方法,用于复杂的决策任务。该方法称为Mini-Batch Risk-Averse Deep Q-Learning,通过将转移风险映射应用于多个样本的经验测量来解决其估计的挑战。该技术被集成到Double Deep Q-Network中,以创建一种风险规避的Q学习算法。 AI
影响 这项研究推动了人工智能中风险感知决策的进步,有可能提高自主系统在不确定环境中的安全性和可靠性。
排序理由 该集群包含一篇详细介绍强化学习新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- Andrzej Piotr Ruszczyński
- Markov decision processes
- mini-batch transition risk mappings
- Q-learning
- reinforcement learning
- underwater robot navigation
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →