Anthropic 正在内部使用一款新的、未发布的人工智能模型,该模型显著优于其当前的 Mythos 5 模型。这款被称为“模型 2”的先进模型在 CoBench v2 基准测试中得分高出 12.5 个百分点,该基准测试评估了历史人工智能研发问题的解决能力。尽管性能优越,Anthropic 表示目前没有向公众发布的计划。 AI
影响 凸显了领先实验室内部人工智能能力的进步,暗示了内部工具与公开产品之间的差距。
排序理由 该条目讨论的是内部模型的性能以及 Anthropic 不发布它的决定,而不是官方发布或研究论文。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →