Dyna Robotics 推出了 Dyna-2,这是一款专为机器人操作任务设计的新型世界动作模型。该模型在超过一百万小时的人类第一视角视频的广泛数据集上进行了预训练,旨在克服机器人学习中动作标记数据的瓶颈。Dyna-2 使用了视频扩散骨干网络和 Transformer 的混合体,分别处理视频和动作 token,同时允许它们相互关注。研究表明,在人类数据上存在一个清晰的缩放定律,该定律成功地迁移到了未见的机器人数据上,表明视频预测是这种跨具身泛化的关键驱动因素。 AI
影响 该模型在人类视频上进行的广泛训练,可以通过减少对昂贵、精心策划的机器人特定动作数据的依赖,来显著提升机器人操作能力。
排序理由 前沿实验室模型发布,附带系统卡。[lever_c 从 frontier_release 降级:ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →