Anthropic 发布了 Claude Opus 5,据报道该模型在大多数基准测试中能与现有顶级模型相媲美甚至超越。值得注意的是,Claude Opus 5 在编码和自动化任务方面显著优于竞争对手,在 ARC-AGI 3 基准测试中的得分是第二名模型的两倍。尽管功能强大,但其定价却只有同类模型的一半。 AI
影响 在编码和自动化基准测试中设定了新的 SOTA(State-of-the-Art),凭借其激进的定价,有可能颠覆高端 AI 模型市场。
排序理由 前沿实验室模型发布,系统卡 [lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →