一位用户报告称,Anthropic 的 Claude Opus 5 (High) 模型在协助 API 服务目录自动化时表现出明显的幻觉问题。当被问及完成某项功能的后续步骤时,该模型错误地建议合并三个拉取请求,偏离了最初一个拉取请求加一个测试拉取请求的计划。用户还指出,当被问及第三个拉取请求的身份时,该模型给出了一个无意义的回答。 AI
影响 凸显了先进模型中潜在的可靠性问题,影响了用户对复杂自动化任务的信任和采用。
排序理由 用户报告模型幻觉,非官方发布或基准测试。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →