研究人员发现了一种解密GPT-5、Claude Opus和Gemini等先进AI模型的内部推理过程的方法。此次攻击成本约为720美元,利用了一个关键的管理漏洞,该漏洞允许较弱的模型充当解密加密的“思维链”数据的预言机。该漏洞可能暴露专有的推理方法、敏感用户数据并绕过安全系统。据报道,OpenAI、Anthropic和Google这三大AI提供商在研究公开披露之前已经修补了核心漏洞。 AI
影响 暴露了LLM API中知识产权被盗和安全绕过的潜在可能性,需要开发人员立即采取缓解措施。
排序理由 研究论文详细介绍了针对LLM推理加密的新型攻击向量。
在 Mastodon — sigmoid.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →