研究人员发现,Anthropic、OpenAI和Google等主要LLM提供商在处理专有模型推理痕迹方面存在漏洞。通过利用跨会话和跨模型的加密推理块的可互换性,攻击者可以迫使较弱的模型泄露更强大模型的明文痕迹。此方法允许提取专有推理、从公共日志中检索PII和凭证等敏感数据、暴露危险信息以及执行不可见的提示注入。提出的缓解措施侧重于加密和系统级别的安全增强。 AI
影响 暴露了LLM API中的关键安全漏洞,可能影响数据隐私、知识产权以及代理系统的安全性。
排序理由 详细介绍LLM API安全方面新颖漏洞和攻击向量的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →