研究人员开发了一种名为IAU-FOA的新方法,以提高对抗性攻击对闭源多模态大语言模型(MLLMs)的有效性。该技术通过在全局和局部层面进行特征对齐来增强对抗性样本的可迁移性,解决了先前主要使用全局图像级特征的方法的局限性。IAU-FOA结合了置信度自适应不平衡传输进行细粒度特征对齐,以及视觉不变性增强,以确保对抗性扰动能够跨不同的视觉编码器泛化,在性能上优于现有方法。 AI
影响 这项研究可能有助于开发更强大的防御措施,以应对多模态人工智能系统面临的对抗性攻击。
排序理由 该集群包含一篇研究论文,详细介绍了一种针对多模态大语言模型的新型对抗攻击方法。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →