佐治亚理工学院助理教授兼NVIDIA研究员Danfei Xu认为,当前高保真视频生成模型并不等同于真正的机器人规划能力。他强调了“视频-动作鸿沟”,即机器人可以预测逼真的未来场景,但由于缺乏真实世界的规划而无法在物理上执行。Xu提出了一种“组合世界模型”方法,在测试时使用模块化组件和因子图动态组装技能,使机器人能够更有效地处理复杂任务和物理约束。 AI
影响 尽管AI视频预测取得了进展,但突出了机器人执行能力的关键差距,为具身AI指明了新的研究方向。
排序理由 学术会议演讲,讨论一种新颖的机器人规划方法。[lever_c_demoted from research: ic=1 ai=1.0]
- Danfei Xu
- Factor graphs and the sum-product algorithm
- Georgia Tech
- Marvin Minsky
- NVIDIA
- RSS 2026
- Sora
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →