PulseAugur
实时 10:37:47
实体 ActivityNet Captions

ActivityNet Captions

PulseAugur coverage of ActivityNet Captions — every cluster mentioning ActivityNet Captions across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 4
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 4 条
  1. RESEARCH · CL_128642 ·

    AI框架通过新的路由增强语义视频通信

    研究人员开发了一个用于语义视频通信的生成式AI框架,旨在传输意义而非原始数据。该系统解决了带宽限制下的时间建模和网络边缘的语义对齐方面的挑战。它利用多尺度时间卷积编码器和基于胶囊的动态路由机制来实现高效灵活的通信。

  2. TOOL · CL_70386 ·

    GenSpan 框架改进了复杂动作查询的视频检索

    研究人员开发了 GenSpan,一个用于视频语料库瞬间检索的新框架,该框架专门解决了多动词查询的挑战。GenSpan 利用从字幕线索生成的辅助视频作为时间先验,指导检索过程。这种方法提高了视频和时间片段识别的准确性,尤其是在复杂动作序列方面,同时与现有方法相比还降低了计算需求。

  3. TOOL · CL_63042 ·

    新网络通过知识迁移实现无监督视频-文本匹配

    研究人员开发了一种新颖的跨模态知识迁移网络,用于无监督时间句子定位。该方法旨在通过利用来自更简单、易于获得的跨模态任务的知识,来克服对昂贵、配对的视频-查询注释的依赖。该网络将来自图像-名词任务的实体感知外观知识和来自视频-动词事件的事件感知动作表示进行迁移,并将其改编为无监督使用,以在没有直接训练的情况下关联视频和查询以检索相关片段。

  4. RESEARCH · CL_63060 ·

    PEEK方法高效选择关键视频帧用于字幕生成

    研究人员开发了PEEK,一种从视频中选择关键帧以生成字幕的高效方法。该技术将知识从大型教师模型蒸馏到小型模型中,使其能够以最小的计算开销识别最相关的帧。PEEK的性能优于现有方法,尤其是在使用少量帧时,并且与其他自适应采样方法相比,显著减少了处理时间。