一位 Reddit 用户认为,虽然 Opus 4.6 在当时令人印象深刻,但 Opus 5 在复杂任务上更胜一筹,尽管一些用户声称基于主观的“感觉”或通过比较简单任务得出了相反的结论。该用户承认,对于一般的问答和写作,包括 Opus 5 在内的大多数 LLM 可能表现不佳,但他坚称 Opus 5 在软件和计算任务上优于 Opus 4.6。 AI
影响 表明新模型在复杂任务上提供卓越性能,挑战用户的主观认知。
排序理由 用户对模型性能比较的观点文章。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →