PulseAugur
实时 11:03:30
实体 VLN-CE

VLN-CE

PulseAugur coverage of VLN-CE — every cluster mentioning VLN-CE across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_141765 ·

    新的 Traj-VLN 方法训练视觉语言模型在像素空间中进行导航

    研究人员开发了 Traj-VLN,一种用于连续环境视觉语言导航(VLN-CE)的新方法。该方法侧重于训练视觉语言模型(VLM)直接在二维像素空间中生成导航轨迹,从而绕过了 VLM 通常缺乏的显式三维几何信息。该模型预测一系列像素坐标,以根据语言指令和历史观察指导具身智能体穿越未知环境。实验表明,这种像素空间轨迹监督显著提高了 VLN 的性能,在资源利用效率高的情况下取得了最先进的成果。

  2. TOOL · CL_123083 ·

    新的CoFL-S框架增强了机器人导航的低级动作生成

    研究人员推出了一种新颖的CoFL-S框架,旨在改进视觉语言导航(VLN)任务的低级动作生成。该方法在机器人的局部视图内预测一个语言条件流场,从而能够生成连续轨迹。通过将现有的VLN-CE片段转换为带有对齐子指令和动作目标的帧级监督,CoFL-S得到了训练。与在新的连续时间Habitat基准上的动作令牌和动作块基线相比,该框架表现出优越的性能,并在实际部署中显示了有效性。