一位研究人员已经证明,在开放权重AI模型中引入后门是可行且廉价的。该过程成本不到100美元,涉及微妙地改变模型的训练数据以创建隐藏的触发器。然后可以激活这些触发器,使模型产生意外行为,例如错误地分类特定输入或生成有害内容。 AI
影响 凸显了开源AI开发中的重大安全风险,可能影响这些模型的信任度和采用率。
排序理由 该集群报道了一位研究人员演示了开放权重AI模型中的安全漏洞,这属于研究和安全范畴。
在 Mastodon — sigmoid.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →