研究人员开发了 τ_0-VLA,一个旨在改进长时机器人操作的分层视觉-语言-动作模型。该模型通过在测试时使用世界模型引导的搜索来增强复杂任务的决策能力,使其能够为关键选择分配额外的计算资源。τ_0-VLA 在超过 40,000 小时的真实机器人数据上进行训练,在预测下一个子任务方面表现出显著的改进,并在长时操作任务上提高了闭环成功率。 AI
影响 该模型可以通过改进其决策过程,使机器人能够执行更复杂、耗时更长的任务。
排序理由 该集群包含一篇详细介绍新模型的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Daily Papers 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →