PulseAugur
中
实时 11:17:27
实体 DriveLM

DriveLM

PulseAugur coverage of DriveLM — every cluster mentioning DriveLM across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_259188 ·

    新基准揭示视觉语言模型中的忠实度差距

    研究人员推出了EDCT-Bench,一个旨在识别视觉语言模型(VLMs)忠实度问题的基准。该基准使用一种称为解释驱动的反事实测试(EDCT)的干预式协议,来测试VLMs的解释和答案在对视觉证据进行最小编辑后,与视觉证据的匹配程度。EDCT-Bench涵盖了视觉问答、驾驶场景和3D空间推理等领域,揭示了各种VLMs在模型忠实度方面存在的显著差距。研究还表明,EDCT生成的反事实可以作为改进模型一致性的有效训练信号。

  2. RESEARCH · CL_141094 ·

    CVPR 2026挑战赛针对自动驾驶VLA的对抗性攻击

    一份技术报告详细介绍了CVPR 2026@AdvML研讨会挑战赛,该挑战赛专注于针对自动驾驶视觉语言代理(VLA)的对抗性多模态攻击。挑战赛涉及生成扰动,以诱导解释驾驶场景的VLA产生不正确的响应,并使用了多视图视觉问答。对领先提交内容的分析显示,图像侧攻击是有效的,场景级优化优于孤立视图处理,并且图像中的字体内容呈现出持续的漏洞。