PulseAugur
中
实时 18:00:52
实体 Vid-LLMs

Vid-LLMs

PulseAugur coverage of Vid-LLMs — every cluster mentioning Vid-LLMs across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_287138 ·

    新的RACER框架增强了Vid-LLM的长视频理解能力

    研究人员推出了一种新颖的RACER框架,旨在通过大型语言模型改进长视频理解的帧选择。RACER通过采用反思性代理方法来解决查询理解和解释-选择差距中的挑战。该方法使用轻量级Vid-LLM将复杂查询解释为子查询,并使用嵌入模型作为检索工具来定位相关帧,从而创建迭代改进的反馈循环。