研究人员开发了 REFACTOR-VLA,一种用于视觉-语言-动作 (VLA) 模型中可重用技能的无监督学习的新系统。与输出原始运动指令的整体模型不同,REFACTOR-VLA 将行为组织成抽象的、类型化的运动程序。该系统采用“唤醒/睡眠”方法,其中睡眠阶段根据学习到的潜在世界模型对运动程序片段进行聚类,而唤醒阶段发出类型化的 lambda 项用于动作解码。这种方法显著提高了 LIBERO 基准测试中的技能发现和任务性能,优于现有基线。 AI
影响 这项研究可能带来更具适应性和可解释性的机器人系统,能够处理复杂、长周期的任务。
排序理由 该条目是 arXiv 的预印本,详细介绍了一种在 VLA 模型中学习运动程序的新方法。[lever_c_demoted from research: ic=1 ai=1.0]
- Behavioral-Equivalence Kernel
- Hindley--Milner
- InfoNCE
- LIBERO
- minimum description length
- OpenVLA
- RDT-1B
- real-LIBERO
- REFACTOR-VLA
- RT-2
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →