PulseAugur
实时 21:48:46
English(EN) the h test

Claude Sonnet 5 在简单指令测试中拒绝率增加

一位用户观察到,AnthropicClaude Sonnet 5 模型与早期版本和其他当代 AI 模型相比,表现出更高的拒绝率。用户进行了一项简单测试,指示 AI 重复输出字母 'h' 直到达到其 token 限制。虽然当前版本的 GPTGeminiGrok 都能无问题地完成此任务,但据报道 Sonnet 5 拒绝执行,理由是缺乏自然的停止点或怀疑有不可告人的动机。这与早期 Claude 模型(如 Sonnet 4.6)形成对比,后者在没有抱怨的情况下执行了指令。 AI

影响 表明新版 LLM 在指令遵循能力和安全护栏方面可能发生的变化。

排序理由 用户进行的测试和关于模型行为的观察,而非官方发布或基准测试。

在 r/ClaudeAI 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Claude Sonnet 5 在简单指令测试中拒绝率增加

报道来源 [1]

  1. r/ClaudeAI TIER_2 English(EN) · /u/Complete_Nobody9391 ·

    h测试

    <table> <tr><td> <a href="https://www.reddit.com/r/ClaudeAI/comments/1vr1vf3/the_h_test/"> <img alt="the h test" src="https://preview.redd.it/xk2ckf8phzjh1.png?width=140&amp;height=131&amp;auto=webp&amp;s=49c988222a1af4169c4b148b8b7484e7d2cefb83" title="the h test" /> </a> </td><…