研究人员开发了一种使用对抗性逆强化学习(AIRL)的工业故障检测新方法。该方法将故障检测视为一个离线逆强化学习问题,解决了现实场景中故障标签稀缺的挑战。与忽略时间动态或需要手动奖励工程的传统监督学习或上下文老虎机方法不同,AIRL直接从状态转换中恢复内在的“健康”奖励。该框架在三个运行至失效的基准测试中表现出色,在检测渐进式退化方面优于现有方法。 AI
影响 这项研究为更强大、更少依赖标签的工业故障检测系统提供了潜在解决方案。
排序理由 详细介绍工业故障检测新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- Adversarial Inverse Reinforcement Learning
- arXiv
- Contextual Bandit
- HUMS2023
- Machinery Fault Detection
- Reinforcement Learning
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →