Anthropic 发布了其新的旗舰模型 Claude Opus 5,该模型在包括代理编码和知识工作在内的各种基准测试中表现出卓越的性能,超越了 Fable 5 和 GPT-5.6 Sol 等模型。该公司强调 Opus 5 先进的对齐能力,以及其在安全性的同时匹配 Mythos 5 进行错误检测的能力。此次发布旨在为价格更高的模型提供强大且经济高效的替代方案,定价为每百万个 token 5 美元和 25 美元,与前代 Opus 4.8 类似。 AI
影响 在代理编码和知识工作基准测试中设定了新的 SOTA(State-of-the-Art),可能给 OpenAI 和 xAI 等竞争对手带来压力。
排序理由 带有系统卡的 Frontier-lab 模型发布。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
- Anthropic
- Artificial Analysis’ Intelligence Index
- Claude Code
- Claude Fable 5
- Claude Opus 5
- GPT-5.6 Sol
- GPT-Live
- International Math Olympiad 2026
- Mythos 5
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →