来自 Google Labs 和纽约大学的研究人员开发了一种新颖的机器人训练方法,通过使用视频生成模型替代真实世界交互。这种被称为“World Gym”的方法允许机器人在模拟环境中进行大量低成本的练习,克服了物理反复试验的高昂成本和风险。该系统使用 Diffusion Transformer 架构,根据先前的图像和控制命令生成未来的视频帧,从而实现机器人策略的标准评估和迭代改进。通过利用这个“世界模型”,机器人可以比传统的监督微调或标准模拟器更有效地学习从失败中恢复并执行新任务。 AI
影响 这种方法通过实现广泛的虚拟训练,有可能显著降低具身 AI 的成本并加速其发展。
排序理由 该条目描述了一种用于训练机器人的新研究方法和系统,该方法在顶级机器人会议(RSS)上发表。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →