一位 Reddit 用户对 Anthropic 的 Opus 5 模型在推理方面的能力表示惊讶和赞赏,尽管存在一些明显的缺陷。用户指出,当在 Opus 4.8 或 Sol 等早期模型的指导下时,Opus 5 展现出了令人印象深刻的推理能力。然而,他们也指出该模型有时会偷懒,并且有时无法遵循或正确理解指令,用户将其比作需要监督的患有多动症的孩子。 AI
影响 凸显了模型在高级推理方面的潜力,但也指出了在指令遵循和可靠性方面持续存在的挑战。
排序理由 用户关于模型性能的观点文章。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →