PulseAugur
中
实时 23:04:42
English(EN) PORL: Pretrained Offline Reinforcement Learning for the Job Shop Scheduling Problem

新的PORL方法结合了在线和离线强化学习用于车间调度

研究人员推出了一种新颖的车间调度问题(JSSP)方法PORL,该方法结合了在线强化学习预训练和离线微调。这种混合方法利用基于仿真的交互来探索通用的调度策略,然后使用历史生产数据来调整这些策略。PORL的一个关键特性是其基于KL散度的策略约束,它限制了微调过程中的偏差,以保持预训练策略的优势。评估表明,PORL在处理分布变化和低质量数据集时,始终优于独立的离线强化学习和其他通用调度基线。 AI

影响 这种混合强化学习方法可以通过减少对高质量历史数据的依赖来提高工业调度的效率。

排序理由 该集群包含一篇详细介绍特定优化问题新方法的论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新的PORL方法结合了在线和离线强化学习用于车间调度

报道来源 [1]

  1. arXiv cs.AI TIER_1 English(EN) · Mateo Toro Diz, Jonathan Hoss, Noah Klarmann ·

    PORL:用于车间调度问题的预训练离线强化学习

    arXiv:2609.30948v1 Announce Type: cross Abstract: The Job Shop Scheduling Problem (JSSP) is a fundamental combinatorial optimization problem in industrial optimization. This work introduces Pretrained Offline Reinforcement Learning (PORL), a hybrid approach that combines simulati…