研究人员已经实现了对使用随机傅里叶特征(RFF)的机器学习模型的理论白盒后门攻击。此实现使用NumPy和SciPy等标准科学计算工具构建,测试了此类攻击的实际可行性,这些攻击即使在拥有模型权重完全访问权限的情况下也旨在不可检测。研究发现,在各种稀疏度比率下,后门模型和干净模型之间没有可检测的差异,这有助于理解这些复杂的加密威胁的可实现性。 AI
影响 证明了机器学习模型中不可检测后门的实际可行性,引发了对模型安全和审计的担忧。
排序理由 学术论文,详细介绍了一种理论安全漏洞的新实现。[lever_c_demoted from research: ic=1 ai=1.0]
- CLWE
- Continuous Learning With Errors
- Goldwasser
- GP_d(b_k)
- NumPy
- random Fourier features
- SciPy
- Sparse Gaussian Pancakes
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →