PulseAugur
实时 05:59:15
实体 Pedro Sordo Martínez

Pedro Sordo Martínez

PulseAugur coverage of Pedro Sordo Martínez — every cluster mentioning Pedro Sordo Martínez across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 6
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 6 条
  1. TOOL · CL_213638 ·

    Topowatch 工具衡量 AI 编码助手对提示注入的漏洞

    一个名为 topowatch 的新命令行工具已被开发出来,用于衡量间接提示注入攻击针对编码助手的攻击成功率 (ASR)。该工具基于 arXiv:2608.14876 的研究,该研究表明工作区拓扑结构对 ASR 有显著影响。Topowatch 量化了代理需要读取工作区多少内容才会受到攻击,并提出模块化工作区结构可以通过限制代理的读取访问来降低 ASR。当前版本 (v0.1) 使用合成代理进行可复现测试,未来版本计划针对真实的编码助手进行测试。

  2. TOOL · CL_151350 ·

    Trajectory-Sentinel v0.1.0 关联防御信号以增强代理安全性

    Trajectory-Sentinel v0.1.0 是一款新的监控工具,旨在关联来自 adi-shield、wallet-guardy 和 goal-anchor 等多个传感器的防御信号。它解决了单个传感器只能看到攻击部分视图的局限性,从而能够基于完整的工具调用轨迹做出更全面的决策。该系统采用确定性规则,包括在任何传感器指示中断时阻止操作,当 goal-anchor 检测到漂移而其他传感器允许时确认风险,以及汇总来自多个传感器的已确…

  3. TOOL · CL_151351 ·

    开源 Wallet-Guard 工具为 AI 代理添加了预算和循环控制

    Wallet-Guard,一款新的开源工具,已发布,为 AI 代理提供护栏,特别是解决无限重试循环和预算超支问题。该工具由 Pedro Sordo Martínez 开发,引入了 LoopGuard 和预算机制,以防止代理卡住或超出财务限制。该项目包括全面的测试并已通过审计,尽管其有效性取决于集成商为代理定义清晰的进度衡量标准。

  4. TOOL · CL_151352 ·

    开源工具应对LLM提示注入攻击

    发布了两个开源项目来对抗针对大型语言模型的提示注入攻击。第一个项目由BordairAPI开发,采用两阶段检测系统,结合了快速的正则表达式网关和量化的DeBERTa-v3模型,并包含来自游戏的真实攻击数据。第二个项目adi-shield专注于标记不可信数据源,并在代理执行指令前检测注入的指令,而不依赖于LLM本身。

  5. TOOL · CL_116867 ·

    Hermes Shield 提供商业人工智能代理安全许可证

    Hermes Shield 的开发者,一个用于人工智能代理的安全组件,正在提供专有集成的商业许可证。该项目在 GNU AGPL-3.0 下获得许可,要求商业用户如果不想在相同条款下发布其源代码,则必须获得单独的许可证。提供了许可证咨询和支持的联系信息。

  6. TOOL · CL_116809 ·

    Hermes Shield 为专有 AI 代理保护提供商业许可

    Hermes Shield 的开发者,一个 AI 代理保护组件,正在为专有或闭源集成提供商业许可。该项目主要基于 GNU AGPL-3.0 许可,要求商业用户在不希望开源自身代码的情况下获得单独的许可。提供了 Pedro Sordo Martínez 的联系方式以获取许可咨询和企业支持。