一项新的 AI 记忆规则(称为 N20)正在被提议,以确保 AI 治理的有效性。该规则要求在内容被视为规范记忆之前必须明确推广,这意味着违禁案例必须被积极拒绝,而不仅仅是被忽略。据报道,该系统已在两种模式下成功通过了所有 31 项演示,表明成功拒绝了不符合规定的内容。 AI
影响 该规则旨在通过确保明确拒绝不良内容来提高 AI 安全性,可能带来更强大、更值得信赖的 AI 系统。
排序理由 该集群描述了一项新的 AI 安全/治理规则及其测试,属于研究类别。[lever_c_降级自研究:ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →