研究人员推出 Multi2AV-Safety,这是一个旨在评估多模态音视频生成系统安全性的新型基准。该基准解决了新兴的挑战,即有害内容可能源于多个单独无害输入的交互,而现有的以提示为中心的安全性评估未能充分涵盖这一风险。研究发现,当前的安全性机制难以检测组合风险,即使所有输入都可见,也无法整合跨模态和跨时间的安全性证据。该数据集包含 11,024 个不同条件配置下的攻击实例,计划于 2026 年 10 月公开发布。 AI
影响 凸显了 AI 安全方面的一个关键差距,特别是当前系统无法检测由多个输入组合产生的危害,这可能会加速对更强大的多模态安全性评估的研究。
排序理由 该集群描述了一篇介绍 AI 安全研究新基准的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →