Anthropic 发布了 Claude Fable 5.1 和 Claude Mythos 5.1,在性能上取得了显著提升,尤其是在代理任务方面。Fable 5.1 模型在 Terminal-Bench-Science 基准测试中表现出显著的进步,超越了其前代产品,甚至超越了更昂贵的 Opus 5 模型。一个关键的变化是缓存读取价格的大幅降低,使得代理循环的成本效益大大提高。Anthropic 还澄清说,Fable 和 Mythos 是同一个模型,只是安全配置不同,并公布了两者之间的性能差异,量化了安全限制对通用模型的影响。 AI
影响 此次发布显著降低了运行代理循环的成本,并提高了复杂任务的性能,有可能加速企业对 AI 代理的采用。
排序理由 前沿实验室模型发布,包含系统卡和定价变更。[lever_c 从 frontier_release 降级:ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →