实体
Chris Sattinger
Chris Sattinger
PulseAugur coverage of Chris Sattinger — every cluster mentioning Chris Sattinger across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新的MotionBlind基准揭示视频大语言模型在运动理解方面存在不足
一个名为MotionBlind的新基准已被开发出来,用于测试视频大语言模型(Video-LLMs)的运动理解能力。研究人员发现,大多数开源的Video-LLMs表现不佳,即使在呈现清晰的视觉数据时,也常常无法区分不同的运动速度或方向。虽然Gemini-3.1 Pro有所改进,但在准确评估速度方面仍有困难,这表明当前的Video-LLMs在需要真正理解运动的任务中尚不可靠。
-
新基准揭示视频大模型在时间理解方面存在困难
研究人员开发了TimeBlind,一个旨在测试视频大语言模型(LLMs)时空理解能力的新基准。该基准采用最小对范式,呈现视觉上相同但仅在时间结构上有所不同的视频,以将时间推理与静态视觉线索区分开来。评估显示,即使是GPT-5和Gemini 3 Pro等先进模型,表现也差强人意,准确率仅为48.2%,而人类的准确率为98.2%,这表明模型严重依赖视觉捷径而非真正的时间逻辑。