PulseAugur
实时 07:41:16
实体 MeViS-v2-Audio track

MeViS-v2-Audio track

PulseAugur coverage of MeViS-v2-Audio track — every cluster mentioning MeViS-v2-Audio track across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_13539 ·

    ASR-SaSaSa2VA框架在音频引导视频分割挑战赛中获得第二名

    研究人员开发了ASR-SaSaSa2VA,一个旨在改进音频引导视频目标分割的新框架。该方法将音频输入转换为文本运动描述,然后由预训练的文本视频分割模型进行处理。为了提高其性能,该系统包含一个模块,用于检测和过滤掉不指代任何目标对象的音频片段,使其对模糊的音频输入更加鲁棒。该框架在第五届PVUW挑战赛MeViS-v2-Audio赛道中以80.7分的成绩获得第二名。