PulseAugur
实时 08:58:45
实体 Open-Vocabulary Audio-Visual Semantic Segmentation

Open-Vocabulary Audio-Visual Semantic Segmentation

PulseAugur coverage of Open-Vocabulary Audio-Visual Semantic Segmentation — every cluster mentioning Open-Vocabulary Audio-Visual Semantic Segmentation across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_229476 ·

    新框架改进音视频语义分割

    研究人员开发了一种名为声学基础成本学习(AGCL)的新框架,用于开放词汇量音视频语义分割。该方法旨在通过使学习过程特定于类别和基于声音,来改进发声对象的像素级分割。AGCL 利用生成声音调制的成本和声音引导的时间聚合的模块来突出发声区域并完善时间方面,而协同干扰项挖掘策略有助于区分声学上和语义上令人困惑的类别。在 AVSBench-OV 数据集上的实验表明,该方法显著优于先前最先进的方法,尤其是在未见过类别方面。