PulseAugur
实时 11:24:44
实体 Qwen-MusicAVQA-7B

Qwen-MusicAVQA-7B

PulseAugur coverage of Qwen-MusicAVQA-7B — every cluster mentioning Qwen-MusicAVQA-7B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_198317 ·

    Qwen-MusicAVQA-7B模型以高效设计增强音乐视听问答能力

    研究人员开发了Qwen-MusicAVQA-7B,一个专为音乐视听问答设计的​​多模态模型。该模型使用学习到的线性投影,有效地将一个冻结的Whisper音频编码器与Qwen2-VL-7B-Instruct语言模型连接起来。该系统在MUSIC-AVQA基准测试中表现强劲,准确率达到96.0%,并强调了在有效的视听问答中保留音频表示中细粒度时间信息的重要性。