实体
Agent Security Bench
Agent Security Bench
PulseAugur coverage of Agent Security Bench — every cluster mentioning Agent Security Bench across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新的SAVOR方法增强了针对LLM代理的单次提示注入攻击
研究人员开发了SAVOR(Strategy Abstraction Via Outcome-Conditioned Reflection,通过结果条件反射进行策略抽象),一种针对使用工具的大型语言模型代理的间接提示注入攻击的新型对抗方法。SAVOR将攻击适应从迭代查询转移到离线策略蒸馏,从而能够针对未知的目标代理进行单次攻击载荷。该方法在多个基准测试和受害者模型上显著优于先前的方法,实现了更高的攻击成功率,并展示了学习到的策略对不同防…
-
研究人员提出用于保护人工智能代理和多代理系统的新框架
2026年4月发布的多篇研究论文解决了自主AI代理系统中日益增长的安全挑战。这些论文提出了增强交互式AI代理的安全、可信赖和治理的框架和方法论,特别是在网络安全和企业系统等高风险领域。关键主题包括去中心化架构、形式化验证方法、运行时安全执行以及强大的审计机制,以减轻对抗性攻击、数据投毒和未经授权的操作等风险。