PulseAugur
实时 10:15:49
实体 ActiveVision

ActiveVision

PulseAugur coverage of ActiveVision — every cluster mentioning ActiveVision across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_151912 ·

    新的ActiveVision基准揭示多模态大语言模型缺乏类似人类的视觉观察能力

    一个名为ActiveVision的新基准被开发出来,用于测试多模态大语言模型(MLLMs)的主动观察能力。该基准包含17项任务,旨在衡量这些模型在中间假设下重定向视线的能力,类似于人类视觉。早期评估显示,即使是GPT-5.5和Claude Fable-5等顶级模型表现也很差,仅解决了很小一部分任务,远低于平均完成率超过96%的人类参与者。研究表明,当前的多模态大语言模型缺乏强大的主动视觉观察能力,这凸显了在架构和训练目标方面进行改进的…