Dyna Robotics发布了Dyna-2,一个新颖的世界动作模型,专为机器人操作任务设计。该模型在超过一百万小时的人类以自我为中心的视频的广泛数据集上进行了预训练,旨在克服机器人学习中动作标记数据的瓶颈。Dyna-2采用视频扩散骨干网络和混合Transformer,分别处理视频和动作标记,同时允许它们相互关注。研究表明,人类数据上存在清晰的扩展定律,该定律成功地迁移到未见过的机器人数据上,表明视频预测是这种跨具身泛化的关键驱动因素。 AI
影响 该模型在人类视频上进行的广泛训练可以通过减少对昂贵、精心策划的机器人特定动作数据的依赖,来显著提升机器人操作能力。
排序理由 前沿实验室模型发布,附带系统卡。[lever_c 从 frontier_release 降级:ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →