PulseAugur
实时 11:59:00
English(EN) Anthropic Secretly Nerfed Claude for Six Weeks. Then They Admitted It.

Anthropic 承认秘密削弱 Claude 的推理能力六周

Anthropic 已承认在六周内秘密削弱了其 Claude AI 模型的推理能力。该问题始于 3 月 4 日,当时模型的推理努力从 HIGH 降至 MEDIUM,导致思维链变短,复杂任务的错误增加。3 月 26 日的一个缓存错误加剧了这种退化,删除了推理历史,导致基准准确率下降 18 个百分点。Anthropic 直到 5 月 28 日才披露这些问题,恰逢 Opus 4.8 发布。 AI

影响 此事件凸显了 AI 模型性能透明度的重要性,以及未披露的性能下降对用户可能产生的影响。

排序理由 该集群讨论的是过去发生的事件以及 Anthropic 的承认,而不是新的发布或开发。

在 Medium — Claude tag 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

Anthropic 承认秘密削弱 Claude 的推理能力六周

报道来源 [2]

  1. Towards AI TIER_1 English(EN) · Dr Swarneendu AI ·

    Anthropic 秘密削弱 Claude 六周。然后他们承认了。

    <div class="medium-feed-item"><p class="medium-feed-snippet">Reasoning effort dropped from HIGH to MEDIUM on March 4. A caching bug deleted reasoning history on March 26. Benchmark accuracy fell 18&#x2026;</p><p class="medium-feed-link"><a href="https://pub.towardsai.net/anthropi…

  2. Medium — Claude tag TIER_1 English(EN) · Dr Swarneendu AI ·

    Anthropic Secretly Nerfed Claude for Six Weeks. Then They Admitted It.

    <div class="medium-feed-item"><p class="medium-feed-snippet">Reasoning effort dropped from HIGH to MEDIUM on March 4. A caching bug deleted reasoning history on March 26. Benchmark accuracy fell 18&#x2026;</p><p class="medium-feed-link"><a href="https://swarnenduiitb2020i.medium.…