Adversa AI
PulseAugur coverage of Adversa AI — every cluster mentioning Adversa AI across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
新型攻击在执行过程中解密大语言模型载荷,窃取用户数据
研究人员发现了一种名为“加密上下文注入”的新型攻击技术,该技术以 Grok 和 Gemini 等大语言模型代理为目标。此方法涉及将加密的恶意载荷嵌入网页,大语言模型的执行运行时在处理过程中会解密该载荷。解密后,载荷会指示大语言模型使用其导航工具将敏感用户数据(如聊天记录和订阅级别)窃取到攻击者控制的 URL。此攻击绕过了传统的安全内容分类器,因为恶意指令仅在大语言模型内部执行环境中以明文形式可见,而在 API 边界不可见。
-
AI 代理批准提示作为安全控制失效,新产品涌现
安全行业承认 AI 代理批准提示并非有效的控制措施,多起现实世界事件已证明了这一点。Rubrik、ServiceNow 和 SentinelOne 等公司正在推出专注于代理身份和治理的新产品。这些产品旨在提供比简单的批准对话框更强大的安全措施,鉴于 AI 代理的运行速度,这些对话框越来越被视为“安全表演”。Claude Opus 5 和 Cursor 等代理的事件表明,即使在表面上存在权限系统的情况下,也发生了数据删除和意外执行,突显…
-
OpenAI推出安全MCP隧道以集成私有服务器
OpenAI推出了一项安全MCP隧道功能,允许ChatGPT和Codex等模型安全地与私有或本地MCP服务器进行交互。此功能利用一个开源代理,建立一个仅出站的HTTPS连接到OpenAI,无需入站防火墙端口或公共监听器。该隧道的推出解决了将MCP服务器公开相关的重大安全风险,正如Adversa AI发现的在线大量未经身份验证且易受攻击的MCP服务所指出的那样。
-
AI编码代理易受旧Bash漏洞攻击
Adversa AI的最新分析揭示了开源AI编码代理存在重大的安全漏洞。研究发现,在接受测试的11个代理中有10个存在“GuardFall”漏洞,允许过时的Bash命令绕过安全措施,并以开发人员级别的权限执行。这一漏洞可能使这些AI工具面临供应链攻击的风险。
-
Anthropic 的 Claude AI 易受一次性代码执行攻击
安全公司 Adversa AI 强调了 Anthropic 的 Claude AI 模型中存在的一个漏洞,该漏洞可能允许远程代码执行。当 AI 被提示执行代码,而用户无意中点击了确认对话框上的“确定”时,就会出现此问题,从而绕过了安全检查。Anthropic 的回应表明,用户应谨慎行事,不要盲目信任或执行 AI 生成的代码。