PulseAugur
实时 10:23:59
实体 AVCap-100K

AVCap-100K

PulseAugur coverage of AVCap-100K — every cluster mentioning AVCap-100K across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_191421 ·

    新型AVCap模型通过丰富的数据集和指标增强视听字幕

    研究人员推出AVCap,一种用于详细视听联合字幕的新型模型,解决了现有数据集和评估方法的局限性。该模型在AVCap-100K上进行训练,这是一个包含10万个时间对齐、丰富的视听字幕的新数据集。AVCap采用细节感知GRPO(Da-GRPO)强化学习方法,在开源模型中取得了最先进的性能。为了进一步推动该领域的发展,该团队还开发了AVCap-Bench和AVCap-Score,这是一个用于评估视听字幕中原子级细节的专用基准和指标。