Opus 4.5 模型展示了一种新行为,它会质疑和澄清模糊的提示词,而不是做出假设并继续进行可能错误的解释。这种从服从性功能到质询性的转变给现有的代理基础设施带来了挑战,因为这些基础设施是建立在提示词服从的假设之上的。虽然这种行为可以消除由自信、听起来合理但错误的答案引起的一类错误,但它也引发了对确定性以及模型提出无益或误导性问题的担忧。 AI
影响 该模型倾向于澄清提示词,可能需要对代理基础设施进行重大重新设计,以处理新的输出类型并确保确定性行为。
排序理由 该条目讨论了特定模型(Opus 4.5)的行为及其对 AI 代理基础设施的影响,将其视为观察和分析,而不是正式发布或基准测试。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →