Anthropic 已承认在六周内秘密削弱了其 Claude AI 模型的推理能力。该问题始于 3 月 4 日,当时模型的推理努力从 HIGH 降至 MEDIUM,导致思维链变短,复杂任务的错误增加。3 月 26 日的一个缓存错误加剧了这种退化,删除了推理历史,导致基准准确率下降 18 个百分点。Anthropic 直到 5 月 28 日才披露这些问题,恰逢 Opus 4.8 发布。 AI
影响 此事件凸显了 AI 模型性能透明度的重要性,以及未披露的性能下降对用户可能产生的影响。
排序理由 该集群讨论的是过去发生的事件以及 Anthropic 的承认,而不是新的发布或开发。
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →