研究人员发现,用于检测AI生成图像的视觉语言模型(VLM)存在漏洞。研究表明,字体攻击(通过微妙地改变图像中的文本)会误导这些模型将图像分类错误。这种漏洞在各种类型的VLM中都观察到,包括开源模型和商业模型,其中较大的模型在干净数据上显示出更高的准确性,并且更容易受到这些攻击的影响。 AI
影响 凸显了AI生成图像检测系统潜在的安全风险,表明需要更强大的防御措施来抵御对抗性攻击。
排序理由 该集群包含一篇详细介绍AI模型新漏洞的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →