最近的一篇论文详细介绍了一种从大型语言模型(包括 ClosedAI 的模型)中恢复加密推理痕迹的方法。研究表明,尽管进行了加密,但这些模型的底层推理过程仍可被重建。这一发现对理解模型行为以及对人工智能的安全性和透明度具有影响。 AI
影响 这项研究可以增强对大型语言模型决策过程的透明度,并可能影响专有模型的安全性。
排序理由 该集群包含一篇研究论文的链接,该论文详细介绍了一种从大型语言模型中恢复加密推理痕迹的新方法。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →