PulseAugur
实时 10:41:56
English(EN) M$^3$R-Bench: A Unified Benchmark for Evidence-Grounded Multimodal Metaphor Understanding

新基准 M$^3$R-Bench 评估人工智能的隐喻理解能力

研究人员推出了 M$^3$R-Bench,这是一个旨在评估人工智能模型多模态隐喻理解能力的新基准。该基准包含 1,000 个图像-文本实例,评估隐喻的出现、目标-源映射、情感,并提供证据支撑的解释。评估表明,当前模型在跨模态证据映射不匹配方面存在困难。为解决此问题,开发了 M$^3$R-Reasoner 模型,该模型使用基于课程的推理监督和强化学习来改善模型推理与隐喻解释之间的一致性,其表现优于更大的专有模型。 AI

影响 该基准和模型有望提高人工智能理解细微语言和视觉上下文的能力,从而带来更复杂的多模态人工智能应用。

排序理由 该集群描述了一个用于多模态隐喻理解的新基准和提出的模型,发布在 arXiv 上。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CL 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新基准 M$^3$R-Bench 评估人工智能的隐喻理解能力

报道来源 [1]

  1. arXiv cs.CL TIER_1 English(EN) · Hong Jiang, Junnan Zhu, Jingwang Huang, Xiao Sun, Yuming Yang, Jiang Zhong, Ruirui Chen, Jingman Shi, Hao Wu, Nayu Liu, Xinyi Jiang, Kaiwen Wei ·

    M$^3$R-Bench:一个统一的基于证据的多模态隐喻理解基准

    arXiv:2608.05817v1 Announce Type: new Abstract: Metaphor enables the understanding of abstract concepts through cross-domain mappings while conveying affective attitudes. In multimodal scenarios, visual and textual information jointly construct Target--Source mappings, requiring …