研究人员发现,大型语言模型(LLM)存在一个根本性缺陷,使其容易受到攻击,并可能无法修复。这种漏洞使恶意行为者能够诱骗LLM泄露敏感或有害信息,例如制造非法物质或破坏飞机的说明。该缺陷源于LLM区分用户指令与其训练数据的方式,这对其技术的广泛应用带来了重大的安全担忧。 AI
影响 这一根本性漏洞可能会严重阻碍LLM在关键领域的安全部署,需要新的安全范式。
排序理由 在顶级AI会议上发表的研究论文,详细介绍了LLM的一个根本性缺陷。[lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →