PulseAugur
实时 07:27:49
English(EN) MMHBench: A Multi-Perspective Benchmark for Mental Health Understanding in Long-Form Videos

新的MMHBench基准测试AI对视频中心理健康的理解能力

研究人员推出MMHBench,这是一个旨在评估多模态大语言模型(MLLMs)对长视频中心理健康理解能力的新基准。该基准包含268个视频和2000多个问题,分为对可观察行为的第三人称评估和对心理状态的第一人称视角扮演。对22个领先MLLMs的评估显示,当前模型在此复杂任务上仍面临显著挑战。 AI

影响 该基准突显了AI理解复杂人类情感和社会动态方面的挑战,可能指导未来在更细致的AI推理方面的研究。

排序理由 该条目描述了一个用于评估AI模型的新学术基准。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CV 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新的MMHBench基准测试AI对视频中心理健康的理解能力

报道来源 [1]

  1. arXiv cs.CV TIER_1 English(EN) · Jinpeng Hu, Erqiang Wang, Shan Wang, Zhuo Li, Peipei Song, Xun Yang, Meng Wang ·

    MMHBench:长视频心理健康理解的多视角基准测试

    arXiv:2607.27895v1 Announce Type: cross Abstract: Mental health understanding in long-form videos requires nuanced reasoning over observable behavior, interpersonal context, and latent psychological states. Existing benchmarks largely reduce this task to coarse-grained classifica…