研究人员开发了 ForeTime-VLA,这是一种用于操纵运动物体的新策略,它改进了现有的视觉-语言-动作模型。该策略从世界动作模型中蒸馏出具有未来意识的表示,使其能够更有效地预测接触事件。在传送带数据集上的定量评估中,ForeTime-VLA 证明了平均绝对误差和 L2 误差的降低,但延迟略有增加。与之前的方法相比,实际机器人测试显示了在抓取静止和移动物体方面的成功率有了显著提高。 AI
影响 这项研究可能导致更强大的机器人系统能够处理动态环境,从而可能影响物流和制造业。
排序理由 该集群包含一篇详细介绍新 AI 模型/策略的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →