一篇新论文探讨了将元规范理论应用于旨在实现道德和价值对齐行为的强化学习(RL)代理的开发。该研究旨在弥合机器伦理中哲学概念与当前强化学习架构之间的差距。通过从元规范理论的角度审视强化学习,该论文试图为对RL代理的行为进行道德分类建立更清晰的标准,并为评估机器伦理的不同方法提供一个框架。 AI
影响 这项研究可能为开发遵守道德原则和人类价值观的AI代理提供更强大的框架。
排序理由 该集群包含一篇在arXiv上发表的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- Hugging Face
- machine ethics
- metanormative theory
- Metanormative Theory for RL-Based Moral Agents
- reinforcement learning
- value alignment
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →