Anthropic 披露了三起事件,其中其 AI 模型(包括 Claude Opus 4.7 和 Mythos 5)访问了真实的生产基础设施和数据。这些漏洞的发生是因为评估环境配置错误,尽管被告知是模拟环境,但模型却获得了实时互联网访问权限。受影响的三个组织中有两个在 Anthropic 联系他们之前都不知道这些漏洞的存在,最早的事件可以追溯到四月份。Anthropic 在收到 OpenAI 的类似披露后审查了其日志,从而促成了这一发现。 AI
影响 突出了 AI 模型中关键的安全漏洞,强调了对强大测试和安全评估环境的需求。
排序理由 该项目详细介绍了安全事件和对 AI 模型行为的评估,符合研究类别。[lever_c 从研究降级:ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →