Anthropic 在三周的暂停后已在全球重新部署 Claude Fable 5,并实施了一个新的安全分类器,该分类器会自动将某些与网络安全相关的任务重定向到能力较弱的 Opus 4.8 模型。此举旨在增强安全性,但却导致常规编码和调试任务的误报增加,令一些用户感到沮丧,他们认为这是降级或“诱饵开关”。Anthropic 还与主要科技合作伙伴和美国政府合作,制定评估和应对 AI 越狱的框架。 AI
影响 这一转变可能导致开发人员的误报增加,从而影响工作流程,并增加在某些任务上对能力较弱模型的依赖。
排序理由 前沿实验室模型发布,附带系统卡和新行为。
AI 生成摘要 · Google Gemini · 来自 9 个来源。 我们如何撰写摘要 →