实体
DriveLM
DriveLM
PulseAugur coverage of DriveLM — every cluster mentioning DriveLM across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新基准揭示视觉语言模型中的忠实度差距
研究人员推出了EDCT-Bench,一个旨在识别视觉语言模型(VLMs)忠实度问题的基准。该基准使用一种称为解释驱动的反事实测试(EDCT)的干预式协议,来测试VLMs的解释和答案在对视觉证据进行最小编辑后,与视觉证据的匹配程度。EDCT-Bench涵盖了视觉问答、驾驶场景和3D空间推理等领域,揭示了各种VLMs在模型忠实度方面存在的显著差距。研究还表明,EDCT生成的反事实可以作为改进模型一致性的有效训练信号。
-
CVPR 2026挑战赛针对自动驾驶VLA的对抗性攻击
一份技术报告详细介绍了CVPR 2026@AdvML研讨会挑战赛,该挑战赛专注于针对自动驾驶视觉语言代理(VLA)的对抗性多模态攻击。挑战赛涉及生成扰动,以诱导解释驾驶场景的VLA产生不正确的响应,并使用了多视图视觉问答。对领先提交内容的分析显示,图像侧攻击是有效的,场景级优化优于孤立视图处理,并且图像中的字体内容呈现出持续的漏洞。