PulseAugur
实时 23:39:29
实体 BenSMOT

BenSMOT

PulseAugur coverage of BenSMOT — every cluster mentioning BenSMOT across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_62806 ·

    CaptionFormer模型统一视频对象跟踪和字幕生成

    研究人员开发了CaptionFormer,这是一种新颖的端到端模型,旨在统一视频中的对象检测、分割、跟踪和字幕生成任务。为了解决密集视频对象字幕生成中带注释数据有限的挑战,该团队使用视觉语言模型生成了合成字幕,并用这些新注释扩展了现有数据集。CaptionFormer在三个既定基准VidSTG、VLN和BenSMOT上展示了最先进的性能。