研究人员开发了DistScan,一个用于检测目标检测模型后门的新型框架。该方法通过分析模型在干净数据上预NMS预测类别分布的偏移来识别恶意修改,这与正常训练频率不同。DistScan无需访问模型权重或了解触发器,并且在现有技术之上表现出色,尤其是在场景级攻击方面。 AI
影响 引入了一种增强已部署目标检测模型安全性和可靠性的新方法。
排序理由 学术论文,详细介绍了检测AI模型后门的新方法。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →