研究人员开发了MAR-12,一个旨在检测和解释互联网表情包中{-#有害幽默-#}的新框架。该系统利用视觉语言模型(VLMs),并通过源自幽默和仇恨理论的十二个结构化视角来解读表情包。MAR-12然后采用软门控注意力机制来权衡每个视角的{-#重要性-#},然后做出最终分类。该框架还基于这些视角和注意力权重生成解释,旨在提高透明度和可解释性,并在基准数据集上表现出强劲的性能。 AI
影响 增强了AI理解表情包等{-#细微内容-#}的能力,提高了多模态AI系统的安全性和可解释性。
排序理由 介绍新AI框架和{-#方法的学术论文-#}。 [lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →