研究人员开发了一种名为SM Trap的新方法,能够针对大型推理模型(LRM)发起低成本的拒绝服务(DoS)攻击。该技术通过利用可满足性模理论(SMT)求解器的冲突计数来指导创建计算密集型查询,从而绕过了直接模型反馈或训练单独攻击模型的需要。研究发现,更高的SMT冲突计数与LRM中增加的回溯搜索相关,导致更长的输出生成时间。SM Trap是一个仅CPU的框架,在七个前沿模型上展示了比现有方法显著更强的DoS效果,同时还展示了一种减少令牌使用量的潜在缓解策略。 AI
影响 这项研究揭示了大型推理模型的新漏洞,可能影响其在实际应用中的安全性和可靠性。
排序理由 详细介绍针对LLM的新攻击方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →