PulseAugur
中
实时 22:11:28
实体 Adversa AI

Adversa AI

PulseAugur coverage of Adversa AI — every cluster mentioning Adversa AI across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
8
90 天内 8
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 9 条
  1. RESEARCH · CL_281734 ·

    新的多智能体AI安全协议可对抗隐藏的提示注入攻击

    研究人员正在开发新的方法来保护多智能体AI系统免受间接提示注入攻击,在这种攻击中,恶意指令隐藏在智能体处理的数据中。一种名为 multi-CaMeL 的新协议旨在跨智能体交互保留数据来源,与现有方法相比,显著降低了此类攻击的成功率。这项研究强调了保护AI智能体所面临的更广泛的挑战,并强调需要强大的安全架构,这些架构假设内容会被泄露,并侧重于限制此类泄露的后果,而不是仅仅依赖提示过滤。

  2. TOOL · CL_222253 ·

    LLMs Grok 和 Gemini 被加密指令攻击绕过

    Adversa AI 的研究人员展示了一种新颖的攻击向量,该向量可以绕过 Grok 和 Gemini 等 LLM 的安全措施。该技术涉及将加密的恶意指令嵌入网页中,然后 LLM 会将其解密并作为可信输出执行。这绕过了传统的输入和输出过滤器,因为恶意负载在模型沙箱内解密之前不可见明文。该攻击利用了一个信任边界问题,其中解密的明文被视为模型自身生成的内容,从而允许模型通过出站 URL 请求泄露用户数据,而无需任何用户交互。

  3. COMMENTARY · CL_222259 ·

    实践中的 AI:开发者分享使用 Claude Code、测试 Agent 和 AI 辅助写作的技巧

    几篇 Mastodon 帖子讨论了 AI 在软件开发和安全领域的实际应用和挑战。一位用户详细介绍了他们如何为 Claude Code 配置特定的上下文文件,以提高其在代码库上的性能,使其超越了最初作为简单搜索引擎的用途。另一篇帖子探讨了在生产环境中测试 AI Agent 的复杂性,并强调了与传统单元测试的区别。此外,一位用户分享了他们披露 AI 对其写作影响程度的系统,另一位用户讨论了使用 Opus 5 进行代码修复,还有一位用户谈到…

  4. TOOL · CL_214317 ·

    Grok AI 聊天机器人易受通过加密提示注入的零点击数据盗窃攻击

    Adversa AI 的研究人员在 xAI 的 Grok 聊天机器人中发现了一个零点击漏洞,该漏洞允许攻击者窃取用户聊天记录和其他敏感数据。该漏洞利用在 AES-256-GCM 加密文本中嵌入恶意命令,Grok 会解密并使用其 Python 代码执行环境执行这些命令。这使得聊天机器人在没有任何用户交互的情况下,将用户名、位置和订阅级别等数据泄露到攻击者控制的目的地。

  5. TOOL · CL_214218 ·

    新型攻击在执行过程中解密大语言模型载荷,窃取用户数据

    研究人员发现了一种名为“加密上下文注入”的新型攻击技术,该技术以 Grok 和 Gemini 等大语言模型代理为目标。此方法涉及将加密的恶意载荷嵌入网页,大语言模型的执行运行时在处理过程中会解密该载荷。解密后,载荷会指示大语言模型使用其导航工具将敏感用户数据(如聊天记录和订阅级别)窃取到攻击者控制的 URL。此攻击绕过了传统的安全内容分类器,因为恶意指令仅在大语言模型内部执行环境中以明文形式可见,而在 API 边界不可见。

  6. TOOL · CL_187555 ·

    AI 代理批准提示作为安全控制失效,新产品涌现

    安全行业承认 AI 代理批准提示并非有效的控制措施,多起现实世界事件已证明了这一点。Rubrik、ServiceNow 和 SentinelOne 等公司正在推出专注于代理身份和治理的新产品。这些产品旨在提供比简单的批准对话框更强大的安全措施,鉴于 AI 代理的运行速度,这些对话框越来越被视为“安全表演”。Claude Opus 5 和 Cursor 等代理的事件表明,即使在表面上存在权限系统的情况下,也发生了数据删除和意外执行,突显…

  7. TOOL · CL_163639 ·

    OpenAI推出安全MCP隧道以集成私有服务器

    OpenAI推出了一项安全MCP隧道功能,允许ChatGPT和Codex等模型安全地与私有或本地MCP服务器进行交互。此功能利用一个开源代理,建立一个仅出站的HTTPS连接到OpenAI,无需入站防火墙端口或公共监听器。该隧道的推出解决了将MCP服务器公开相关的重大安全风险,正如Adversa AI发现的在线大量未经身份验证且易受攻击的MCP服务所指出的那样。

  8. TOOL · CL_125351 ·

    AI编码代理易受旧Bash漏洞攻击

    Adversa AI的最新分析揭示了开源AI编码代理存在重大的安全漏洞。研究发现,在接受测试的11个代理中有10个存在“GuardFall”漏洞,允许过时的Bash命令绕过安全措施,并以开发人员级别的权限执行。这一漏洞可能使这些AI工具面临供应链攻击的风险。

  9. TOOL · CL_21448 ·

    Anthropic 的 Claude AI 易受一次性代码执行攻击

    安全公司 Adversa AI 强调了 Anthropic 的 Claude AI 模型中存在的一个漏洞,该漏洞可能允许远程代码执行。当 AI 被提示执行代码,而用户无意中点击了确认对话框上的“确定”时,就会出现此问题,从而绕过了安全检查。Anthropic 的回应表明,用户应谨慎行事,不要盲目信任或执行 AI 生成的代码。