Anthropic 发布了 Claude Opus 5,这是一款介于 Sonnet 和 Fable 之间的新中端模型,以 Opus 4.8 的一半价格提供近乎 Fable 的智能。此次发布具有 1M token 的上下文窗口,在其快速模式下处理速度更快,并且安全分类器的干预显著减少,使其更适合自主编码任务。基准测试表明,Opus 5 在 Frontier-Bench 和 CursorBench 等特定于编码的评估中超越了之前的模型,并在 ARC-AGI 的新颖问题解决能力方面显示出显著优势。除了模型更新外,Claude Code v2.1.219 还包括增强的安全功能,如严格的网络允许列表和改进的子代理功能。 AI
影响 在编码基准测试中设定了新的 SOTA,可能降低 AI 驱动的编码代理的成本。
排序理由 Frontier-lab 模型发布,附带系统卡。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 dev.to — Claude Code tag 阅读 →
- Anthropic
- ARC-AGI 3
- Claude Code
- Claude Code v2.1.219
- Claude Fable 5
- Claude Max
- Claude Opus 4.8
- Claude Opus 5
- Claude Pro
- Claude Sonnet
- CursorBench 3.2
- Frontier-Bench v0.1
- OSWorld 2.0
- Zapier AutomationBench
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →