研究人员开发了 AgentMark,一个用于在 LLM 代理的规划行为中嵌入多比特标识符的新型框架。该方法旨在通过对高级决策过程(如工具和子目标选择)添加水印来保护知识产权并提供监管溯源。AgentMark 通过引发和修改代理的行为分布来工作,从而在即使通过黑盒 API 访问代理的情况下,也能保持效用并与现有内容水印技术兼容。在各种环境中的实验表明,它在实际多比特容量和从部分日志中稳健恢复方面是有效的。 AI
影响 引入了一种跟踪和归因代理决策的方法,可能有助于自主系统的知识产权保护和监管合规。
排序理由 学术论文,介绍了一种用于 AI 代理行为水印的新方法。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →