Anthropic 发布了 Claude Opus 5,将其定位为计算生物学和网络安全任务的强大工具。虽然“前沿”模型 Fable 5 在这些领域受到严格限制,Mythos 5 则仅对特定合作伙伴开放,但 Opus 5 提供了一种平衡的方法。它允许发现源代码漏洞,并在中短期生物任务中表现出色,在 Humanity's Last Exam 和 BrowseComp 等基准测试中取得高分。然而,Opus 5 在长期生物设计任务中可能会遇到自我验证循环,这是 Mythos 5 所没有的限制。 AI
影响 Opus 5 对生物/网络任务的特定解锁和基准测试表现可能会加速这些领域的专业化人工智能应用。
排序理由 前沿实验室模型发布,附带系统卡详情。[lever_c 从 frontier_release 降级:ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →