实体
model-swap-agent
model-swap-agent
PulseAugur coverage of model-swap-agent — every cluster mentioning model-swap-agent across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
2 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
安全研究人员发现自己AI准入网关系统存在缺陷
一位安全研究人员发现自己设计的用于防止模型替换攻击的准入网关系统HivePlane存在缺陷。研究人员最初认为当一个已认证的代理尝试在不同模型上运行时,他们发现了一个漏洞,但事实证明测试场景存在缺陷。该网关正确地识别出该工作负载根本从未被认证过,而不是试图替换模型。一个修正后的攻击场景,首先将代理认证到一个模型,然后尝试在另一个模型上运行,成功触发了网关的拒绝机制。
-
开发者成功用自定义安全门禁阻止了四个恶意AI代理
作者详细描述了一项个人实验,他试图使用四种不同的方法绕过自己为AI代理设置的安全认证门禁。每一次尝试都旨在模仿现实世界中的失败模式,例如使用未经认证的模型、替换模型或引入回归错误,但都被门禁成功阻止。文章强调了除了常规测试之外,进行稳健安全测试的重要性,并重点介绍了阻止每个未经授权代理进入生产环境的具体拒绝消息和机制。