一篇新的研究论文质疑了弱监督暴力检测中交互表示的有效性,发现粗略的几何表示效果与更复杂的人体姿态方法相当甚至更好。该研究在XD-Violence和UCF-Crime数据集上进行,表明当前的基准可能受到标题卡和水印等伪影的影响,而不是实际事件证据。研究人员提出了一种使用事件前帧的诊断方法来识别这些来源伪影,这些伪影会掩盖真实的表示差异。 AI
影响 强调了AI基准数据集中潜在的缺陷,敦促采用更稳健的评估方法。
排序理由 发表在arXiv上的研究论文,讨论了AI模型评估的方法论。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →