PulseAugur
实时 10:08:16
实体 SD-MVSum

SD-MVSum

PulseAugur coverage of SD-MVSum — every cluster mentioning SD-MVSum across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 0
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天

过去 90 天内暂无报道。

主题
最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_22427 ·

    新方法和数据集增强了脚本驱动的多模态视频摘要

    研究人员开发了SD-MVSum,一种用于脚本驱动的多模态视频摘要的新方法。该方法通过整合视频的视觉内容、口语音频文字记录以及用户提供的脚本,增强了先前的工作。它利用一种新颖的加权跨模态注意力机制,通过分析模态之间的语义相似性来识别与脚本最相关的视频片段。该团队还扩展了两个大型数据集S-VideoXum和MrHiSum,以支持这些多模态摘要技术的训练和评估。