Anthropic 的 Fable 5.1 模型在旨在评估其生成类人代码能力的特定基准测试中表现下降。这一发现表明该模型最新迭代在编码能力方面可能出现回归。 AI
影响 表明 Anthropic 模型在编码能力方面可能出现倒退,需要进一步调查原因。
排序理由 该集群报告了一个模型在特定基准测试中的表现,属于研究发现。 [lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →