一位软件工程师和机器学习工程师分享了他们使用 Anthropic 的 Opus 5 模型时的体验,发现其能力不如 Opus 4.8 等先前版本,甚至不如更早的 Fable 模型。用户报告称,Opus 5 需要大量的指导和纠正,基本上让用户承担了所有工作,而早期的模型能够自主解决复杂的架构问题。该用户将 Opus 5 与 GPT-5.5/5.6 进行了对比,认为后者过度设计,并提到了一个名为 Codex (Sol) 的工具,他们发现该工具在代码审查方面很有效。 AI
影响 暗示模型能力可能出现退步,影响用户对 AI 辅助的信任和期望。
排序理由 用户对特定模型性能的观点文章。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →