研究人员引入了一种新方法,通过将时间维度纳入微分决策树(DDTs)来增强AI在顺序任务中的决策可解释性。这种被称为时间可解释性的方法利用动作分块来使树的多时间步规划与人类理解保持一致。该研究提出了两种新的策略梯度算法和一种信息论树重构算法,以在训练过程中保持参数效率。在四个模拟环境中进行的实验表明,从蒸馏策略中预热动作分块的DDTs可以产生最有效的时间可解释树,在四个领域中的三个领域中匹配了神经网络策略的性能,同时显著减少了参数数量。 AI
影响 增强了顺序决策任务中的AI安全性和透明度,有望带来更值得信赖的自主系统。
排序理由 介绍AI可解释性新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Daily Papers 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →