PulseAugur
实时 10:38:26
实体 MRBench

MRBench

PulseAugur coverage of MRBench — every cluster mentioning MRBench across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_193995 ·

    新的MRBench基准旨在改进人体运动-文本检索评估

    研究人员推出了MRBench,一个旨在改进人体运动-文本检索评估的新基准。现有的基准受到同质室内运动、数据不平衡和文本描述过于简单化的限制,这阻碍了准确的跨域和跨粒度对齐评估。MRBench通过来自各种来源的异构运动、平衡的类别覆盖以及多粒度描述来解决这些问题,旨在为推进运动-语言对齐提供一个更可靠的测试平台。

  2. RESEARCH · CL_99522 ·

    ELVA框架解决多模态检索中的“粒度盲”问题 · 已追踪2个来源

    研究人员推出了一种新颖的框架ELVA,旨在解决利用多模态大语言模型(MLLMs)的通用多模态检索(UMR)系统中的“粒度盲”问题。粒度盲是指模型在查询中忽略细粒度信息,将所有负样本同等对待。ELVA采用基于规则的、具有可验证奖励的强化学习(RLVR)方法来优化负样本的排名,并增加正负样本之间的相似度差距。为了评估其有效性,开发了一个名为MRBench的新基准,ELVA在该基准上取得了最先进的成果,包括MRBench上的显著13.1%的提升。