Anthropic 更新了其 Claude 5.1 模型,推出了两个独立版本:Fable 5.1 用于通用编码和代理任务,Mythos 5.1 用于专业的网络安全和生命科学研究。这种分离标志着 Anthropic 正致力于将模型的“核心智能”与其“执行权限”解耦。Fable 5.1 展示的一项关键进展是,它能够在长达 38 小时的测试运行中,在无人干预的情况下管理状态漂移,并进行自我纠正和调整其方法。这种能力凸显了运行时间长的 AI 代理需要外部验证和强大的检查点机制来维持准确性和可靠性。 AI
影响 通过分离智能与执行权限以及改进状态管理,增强了长期代理的可靠性。
排序理由 前沿实验室模型发布,带有系统卡 [lever_c 从 frontier_release 降级:ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →