研究人员推出了一种用于潜在世界模型预测控制的新型表示学习方法——Temporal-Distance JEPA (TD-JEPA)。该方法通过从无奖励轨迹中挖掘定向时间成本来增强联合嵌入预测架构 (JEPAs),从而提高了基于目标进展进行规划的能力。TD-JEPA使用相同轨迹的步序作为正样本,跨轨迹对作为启发式负样本,并结合了回滚一致性项。该方法旨在通过揭示离线日志中的时间进展结构,来弥合JEPA世界模型在训练和规划之间的差距。 AI
影响 这项研究可以通过使人工智能系统能够更好地从观测数据中理解和预测未来状态,来改进其规划能力。
排序理由 这是一篇详细介绍AI中一种新表示学习方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- Joint-Embedding Predictive Architectures
- Lewman
- OGB-Cube
- RC-aux
- Temporal-Distance JEPA
- Two Room
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →