MCPTox
PulseAugur coverage of MCPTox — every cluster mentioning MCPTox across labs, papers, and developer communities, ranked by signal.
-
新的“工具投毒”漏洞通过 MCP 元数据针对 AI 代理
在模型上下文协议 (MCP) 中发现了一种新的安全漏洞,称为“工具投毒”。该协议允许 AI 代理与各种工具和资源进行交互。此攻击涉及在工具的元数据中嵌入恶意指令,AI 模型随后将其解释为受信任的上下文,从而在不触发标准安全过滤器的情况下成功执行。MCPTox 基准测试显示了此攻击的高成功率,其中一些模型(如 OpenAI 的 o1-mini)的成功率超过 70%,而另一些模型(如 Claude 3.7 Sonnet)的拒绝率非常低,这…
-
微软警告AI代理数据通过被投毒的工具描述被盗
微软发布了关于模型上下文协议(MCP)工具中一个安全漏洞的警告,该漏洞被称为“MCP工具描述投毒”。攻击者可以在这些工具的自然语言元数据中嵌入隐藏指令,导致AI代理在未被检测到的情况下泄露敏感公司数据。此攻击利用了代理对其工具描述的依赖来理解其能力,因为没有可靠的方法来区分恶意指令和合法指令。更高级的AI模型由于其增强的指令遵循能力而更容易受到攻击,并且工具描述更改缺乏重新批准触发器加剧了风险。
-
AI Agent Protocol MCP 面临关键供应链安全漏洞
在MCP(Meta-Communication Protocol)生态系统中发现了一个重大的安全漏洞,该生态系统广泛用于连接AI代理与外部工具。该漏洞(CVE-2025-53967)允许攻击者通过利用MCP服务器中未经处理的输入参数来获得用户机器上的shell执行权限,特别是那些具有信任输入假设的服务器。MCP生态系统的快速增长、缺乏像包签名或沙箱这样的健壮安全措施,以及更强大的AI模型由于其卓越的指令遵循能力而更容易受到攻击,都加剧…
-
IntentProbe扫描AI模型大脑中的恶意工具描述
一款名为IntentProbe的新工具已发布,它提供了一种检测恶意AI工具描述的新颖方法。与传统的基于文本的扫描器或LLM即判方法不同,IntentProbe分析冻结模型在处理工具描述时的内部激活状态。这种方法旨在识别诸如凭证访问或数据泄露等隐藏意图,这些意图可能被看似无害的词汇所掩盖。