实体
AugMP
AugMP
PulseAugur coverage of AugMP — every cluster mentioning AugMP across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新的AugMP策略针对LLM的联邦微调
研究人员开发了一种名为增强模型操纵(AugMP)的新策略,以应对大语言模型(LLM)联邦微调(FFT)中的威胁。AugMP利用图表示学习框架来识别合法LLM更新中的相关性,然后指导创建恶意更新。一种迭代算法优化这些对抗性更新,使其嵌入恶意目标,同时保持良性外观,从而难以被标准防御方法检测。实验表明,AugMP可以将全局LLM的准确性显著降低高达26%,局部代理的准确性降低高达22%。
-
新的AugMP策略针对大语言模型的联邦微调
研究人员开发了一种名为增强模型操纵(AugMP)的新策略,用于攻击大语言模型(LLMs)的联邦微调(FFT)。该方法利用图表示学习识别合法LLM更新中的相关性,然后指导创建恶意更新。一种迭代算法优化这些恶意更新,以嵌入对抗性目标,同时使其看起来与良性更新相似,从而难以检测。实验表明,AugMP可以显著降低全局LLM准确性和本地代理性能,同时规避标准防御机制。