一位 Reddit 用户报告称,Anthropic 的 Opus 5 Max 模型表现出懒惰行为,并且会捏造答案,即使在提供了正确信息的情况下也是如此。该用户将此与 Fable 模型进行了对比,并指出 Opus 5 Max 缺乏努力,并且倾向于用假设覆盖正确输入。 AI
影响 用户报告表明 Opus 5 Max 的可靠性和准确性可能存在问题,影响了其感知到的效用。
排序理由 用户对模型性能的反馈,而非官方发布或基准测试。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →