一位用户报告称,Anthropic 的 Claude Opus 5 模型出现了重大错误,并且将简单任务复杂化,需要频繁干预。用户发现使用 Gemini 3.7 Flash 进行审计时没有遇到同样的问题。这表明当前的 Anthropic 模型可能存在问题,用户形容这些模型冗长且容易制造新问题。 AI
影响 强调了先进大型语言模型潜在的可靠性问题,建议用户可能需要与其他模型交叉验证输出。
排序理由 用户关于模型性能的报告和意见,并非官方发布或基准测试。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →