Anthropic 已披露,其旨在防止生成生物武器相关内容的模型安全过滤器近一年时间未能正常运行。在此期间,约有 50,000 名外部承包商向 Anthropic 的模型提交了约 1.33 亿次请求,而过滤器处于非激活状态。这一疏忽在公司发布的最新安全报告中有所披露。 AI
影响 凸显了人工智能安全系统中存在的关键漏洞以及大规模模型部署可能带来的潜在风险。
排序理由 一家领先的人工智能实验室发生重大人工智能安全系统故障。 [lever_c_demoted from significant: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →