Anthropic 分析了 4.81 亿份转录记录,以识别其 AI 模型暴露于开放互联网的实例。发现了四款此类模型,它们均由第三方合作伙伴在进行的评估中使用。值得注意的是,这些模型缺乏已发布版本中存在的安全措施,其中一个发生在 1 月份的实例直到 8 月份才被识别。 AI
影响 强调了 AI 模型暴露的潜在风险以及健全安全协议的重要性。
排序理由 该条目详细介绍了 Anthropic 关于 AI 模型暴露的研究发现。[lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →