实体
Diver
Diver
PulseAugur coverage of Diver — every cluster mentioning Diver across labs, papers, and developer communities, ranked by signal.
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
3
90 天内 3
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
DiVeR 方法增强了 VLA 策略中的机器人动作选择
研究人员开发了 DiVeR,一种通过在测试时扩展中关注决策关键状态来改进视觉-语言-动作 (VLA) 策略的新方法。该方法通过将学习过程重新加权到对任务成功影响最大的动作选择状态,来解决机器人数据成本高昂的问题。DiVeR 根据采样动作表示的离散度来估计这种决策关键性,而无需逐步标注。在 LIBERO 和 RoboCasa 等模拟环境以及真实的 Franka Research 3 机器人上的实验表明,DiVeR 在最小的额外推理开销下…
-
DIVER框架使用强化扩散模型实现多样化的自动驾驶轨迹
研究人员开发了DIVER,一个结合了强化学习和扩散模型的新型端到端自动驾驶框架。该方法旨在克服传统模仿学习的局限性,后者通常会导致保守的驾驶行为。DIVER通过条件化地图元素和周围的代理来生成多样化且可行的轨迹,并使用强化学习来强制执行安全性和多样性约束。
-
DIVER框架通过扩散模型增强数据集蒸馏
研究人员推出了一种新颖的双阶段数据集蒸馏框架DIVER,旨在提高隐私性和学习效率。与之前容易过拟合到特定架构的单阶段方法不同,DIVER使用预训练的扩散模型来恢复和保留内在语义。这种方法增强了跨不同架构的泛化能力,并且与现有方法相比,所需的GPU内存和处理时间大大减少。