研究人员发现了一类新的计算机使用代理(CUAs)安全漏洞,称为分支操纵攻击。这些攻击利用了CUAs的动态特性,CUAs必须根据预期的运行时Web内容来分支其执行路径。攻击者可以构造不受信任的数据,将CUA引导至一个预先批准的危险分支,而无需注入明确的恶意指令。一个新的基准测试STEER-Bench,展示了对标准和Dual-LLM CUAs的高攻击成功率。为了解决这个问题,提出了一种名为COBRA的新架构,它将受信任的分支计划与提前的能力限制配对,在保持高实用性的同时显著降低了攻击成功率。 AI
影响 引入了针对AI代理的新攻击向量和潜在的防御措施,影响了AI驱动的自动化安全格局。
排序理由 学术论文,详细介绍了新的安全漏洞和提出的防御机制。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →