PulseAugur
实时 07:40:24
实体 SonicCaps

SonicCaps

PulseAugur coverage of SonicCaps — every cluster mentioning SonicCaps across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_233470 ·

    新的SonicCaps数据集通过多样化字幕增强音频语言模型

    研究人员推出了SonicCaps,这是一个新推出的、大规模的数据集,旨在改进音频语言建模和音频检索。该数据集包含约1500万个字幕,与70万个音频片段配对,使用Qwen3-Omni多模态模型生成。SonicCaps旨在通过提供多样化、细粒度的字幕来克服现有数据集的局限性,这些字幕能够捕捉声学细节并反映听觉感知的模糊性。人类评估表明,SonicCaps字幕被认为更具描述性和精确性,从而在训练CLAP模型进行音频检索和分类任务时提高了性能。