一位用户观察到,Anthropic 的 Claude Sonnet 5 模型与早期版本和其他当代 AI 模型相比,表现出更高的拒绝率。用户进行了一项简单测试,指示 AI 重复输出字母 'h' 直到达到其 token 限制。虽然当前版本的 GPT、Gemini 和 Grok 都能无问题地完成此任务,但据报道 Sonnet 5 拒绝执行,理由是缺乏自然的停止点或怀疑有不可告人的动机。这与早期 Claude 模型(如 Sonnet 4.6)形成对比,后者在没有抱怨的情况下执行了指令。 AI
影响 表明新版 LLM 在指令遵循能力和安全护栏方面可能发生的变化。
排序理由 用户进行的测试和关于模型行为的观察,而非官方发布或基准测试。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →