一位 Reddit 用户报告称,他们的 OpenAI Codex 代理,特别是 5.6 版本,变得过于谨慎和缓慢,过度关注测试和验证,而牺牲了实际的代码生成。这种行为被描述为代理像“受责备的孩子”,与 Gemini Flash 等其他模型相比,生产力显著下降。用户推测这可能是模型将重点放在测试而非输出质量上,导致了“测试死亡螺旋”和对进步的厌恶。 AI
影响 暗示了当前 LLM 产品在代理行为和效率方面可能存在的问题。
排序理由 用户生成的关于模型行为的评论,而非直接发布或公告。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →