一位Reddit用户报告了Anthropic的Opus 5模型存在严重问题,声称它不可靠且经常忽略指令。该用户将Opus 5与其前身Opus 4.8进行了不利的对比,称Opus 4.8在性能上远胜于Opus 5,并且更接近Fable 5。该用户怀疑Opus 5可能为了追求更快的速度而偷工减料,导致用户体验混乱且效率低下,并对其基准测试结果表示质疑。 AI
影响 用户反馈表明Anthropic的Opus 5模型可能存在问题,影响了其感知到的可靠性和指令遵循能力。
排序理由 用户生成的关于特定模型性能的评论文章。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →