实体
AgentMark
AgentMark
PulseAugur coverage of AgentMark — every cluster mentioning AgentMark across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新的水印方法增强了大型语言模型代理的溯源能力,使其更能抵抗伪造
研究人员开发了一种名为语义行为水印(SBW)的新方法,可以在不改变其输出令牌的情况下,将溯源信息嵌入到大型语言模型代理的行为中。与之前容易受到简单释义或伪造攻击的方法不同,SBW 基于语义行为集群,并使用带密钥的抗碰撞分箱技术来防止对手创建伪造的轨迹。该方法在各种大型语言模型代理和基准测试中表现出对释义和伪造的鲁棒性显著提高,但并未完全解决链式重放攻击。
-
研究人员开发 AgentMark,在保持效用的同时为 LLM 代理行为添加水印
研究人员开发了 AgentMark,一个用于在 LLM 代理的规划行为中嵌入多比特标识符的新型框架。该方法旨在通过对高级决策过程(如工具和子目标选择)添加水印来保护知识产权并提供监管溯源。AgentMark 通过引发和修改代理的行为分布来工作,从而在即使通过黑盒 API 访问代理的情况下,也能保持效用并与现有内容水印技术兼容。在各种环境中的实验表明,它在实际多比特容量和从部分日志中稳健恢复方面是有效的。