研究人员发现,OpenAI、Anthropic和Google等主要AI提供商使用的“加密”推理痕迹并非真正安全。这些旨在保护专有推理和敏感数据的痕迹,可以通过使用同一提供商安全性较弱的同级模型来解密并提取为明文。这种漏洞可能导致凭证和个人身份信息暴露,以及绕过专有AI模型的反蒸馏保护。 AI
影响 AI推理痕迹加密中的漏洞可能暴露敏感数据和专有模型信息,需要重新评估当前的安全实践。
排序理由 论文详细介绍了AI模型推理痕迹中的一个安全漏洞。[lever_c_demoted from research: ic=1 ai=1.0]
- Anthropic
- Codeforces
- ELLIS Institute Tübingen
- MATS
- Max Planck Institute for Intelligent Systems
- OpenAI
- Snyk
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →