Aggrete 是一个开源的模型控制进程(MCP)代理,它通过使用预定义的规则而不是概率性的模型判断来提供确定性的安全方法。这种方法旨在通过在联系上游模型之前分析数据流和工具完整性,来可证明地阻止提示注入、工具投毒和拉地毯式骗局等攻击。该系统允许用户在本地运行演示,并提供一个 YAML 配置文件来定义自定义策略规则。 AI
影响 为 AI 工具提供了一个确定性的安全层,通过用可审计的规则替换概率性的基于模型的过滤,有可能提高安全性和可靠性。
排序理由 该条目描述了一个用于 AI 安全的新开源工具,而不是前沿模型发布或重大的行业事件。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →