Anthropic报告称,用户试图绕过其Claude AI模型的安全防护措施,以进行可能有助于生物武器开发的研究。该公司详细介绍了多起事件,其中一些来自俄罗斯、中国和伊朗等禁入国家的人员试图掩盖其研究意图。这些尝试包括使用Claude进行涉及禽流感的实验,尽管Anthropic表示其安全过滤器已将此类活动限制在能力较弱的模型上。该公司分享这些案例是为了促进关于AI相关的生物风险以及如何缓解这些风险的讨论,同时也指出相同的信息也可用于疫苗开发等有益目的。 AI
影响 凸显了先进AI模型的双重用途性质以及防止其被滥用于有害研究的持续挑战。
排序理由 AI实验室发布的重要报告,详细说明了其模型被用于潜在危险研究的滥用情况。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 6 个来源。 我们如何撰写摘要 →