Anthropic 开发了一项名为 GRAM 的新技术,旨在消除或禁用 AI 系统中的危险知识。这项创新旨在通过阻止模型访问或利用有害信息来降低 AI 的风险。Impress Watch 报道了这一进展,并认为这是 AI 安全研究中的一个重要里程碑。 AI
影响 这项技术可以通过阻止模型访问或利用有害信息来显著提高 AI 的安全性。
排序理由 AI 实验室在 AI 安全方面取得的研究里程碑。
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →