Anthropic 发布了 Claude Opus 5,一款新的旗舰级 AI 模型,在人工智能分析智能指数(Artificial Analysis Intelligence Index)和 Agentic Index 等独立基准测试中取得了顶级排名。该模型在包括 Agentic 终端编码和新颖推理在内的各种任务上,显著优于其前身 Claude Opus 4.8 以及 Claude Fable 5 和 GPT-5.6 Sol 等竞争对手。值得注意的是,Claude Opus 5 的定价与 Opus 4.8 相同,使其成为比 Fable 5 更具成本效益的选择,以更低的成本提供了更高的性能。 AI
影响 在关键基准测试中设定了新的 SOTA(State-of-the-Art),同时显著降低了成本,给 OpenAI 和 Anthropic 自家的 Fable 5 等竞争对手带来了压力。
排序理由 前沿实验室模型发布,包含基准性能和定价细节。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
- Agentic Index
- Anthropic
- Artificial Analysis Intelligence Index
- Claude Fable 5
- Claude Opus 4.8
- Claude Opus 5
- Dario Amodei
- Frontier-Bench v0.1
- Gemini
- GPT-5.6
- GPT-5.6 Sol
- Grok
- OSWorld 2.0
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →