RoboDojo
PulseAugur coverage of RoboDojo — every cluster mentioning RoboDojo across labs, papers, and developer communities, ranked by signal.
-
新的VLA模型通过远见和大规模数据增强机器人操作能力
研究人员开发了新的方法来提高机器人领域中视觉-语言-动作(VLA)模型的性能,特别是在复杂、长周期的任务方面。一种方法是“远见残差强化学习”(Foresight Residual RL),它通过引入预测未来子任务成功率的远见值来增强信用分配,从而显著提高整体任务完成率。另一项开发是Xiaomi-Robotics-1,它使用超过10万小时的真实世界机器人轨迹和一个自动标注流程来扩展VLA模型,在各种基准测试中展示了强大的性能和高效的微调…
-
RoboDojo基准揭示AI机器人与人类表现的巨大差距
一项名为RoboDojo的新基准已发布,用于评估具身智能,包含42个模拟任务和18个真实世界机器人任务。该基准突显了当前AI模型与人类表现之间存在的巨大差距,在模拟环境中,最佳模型成功率仅为8.80%,在真实机器人上为12.8%,而人类的成功率分别为76.03%和100%。RoboDojo旨在为具身智能提供标准化和全面的评估,涵盖泛化能力、记忆、精度、长时序执行和开放式语义理解。
-
新模型通过整合视觉和状态来增强机器人操作能力
研究人员开发了几种新方法,通过更好地整合视觉信息与机器人的状态和动作来提高机器人操作能力。例如,GeoProp 是一种轻量级适配器,通过将机器人状态投影到图像平面并注入空间先验来对齐本体感觉和视觉。RoboDojo 提供了一个统一的模拟和真实基准,用于评估通用机器人操作策略在各种任务中的表现。DSWAM 引入了一种双系统方法,将世界动作模型执行器与视觉语言规划器相结合,以实现细粒度操作,而 DynaWM 使用专门针对动态物体操作的基于…