研究人员推出了一种新的面向决策的数字孪生训练范式 DT-2。与专注于最小化单步转移误差的传统方法不同,DT-2 优化数字孪生以进行策略排序和决策。该方法使用拟合 Q 评估来估计策略值,并训练数字孪生以保留这些排序,在各种场景中展示了改进的策略选择和减少的决策遗憾。 AI
影响 引入了一种新的数字孪生训练方法,可改进策略排序和决策。
排序理由 这是一篇详细介绍数字孪生新训练方法的学术论文。
- arXiv
- digital twin
- DT-2
- Hugging Face
- alphaXiv
- CatalyzeX
- Connected Papers
- DagsHub
- Gotit.pub
- IArxiv
- Litmaps
- Q-evaluation
- ScienceCast
- scite Smart Citations
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →