研究人员发现,Anthropic、OpenAI和Google等主要LLM提供商处理AI推理痕迹的方式存在漏洞。这些提供商会加密推理步骤并将其发送回客户端,但加密块在不同会话和模型之间是可互换的。攻击者可以利用这一点来解密专有推理、提取包括PII和凭证在内的私有数据、泄露危险信息以及执行隐形提示注入。研究人员提出了加密和系统级别的缓解措施。 AI
影响 揭示了一种提取专有LLM逻辑和敏感数据的新攻击向量,可能影响模型安全和用户隐私。
排序理由 研究论文详细介绍了LLM推理痕迹处理中的一个漏洞。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →