一位 Reddit 用户分享了关于 Anthropic 的 "Fable 5" 模型出现意外行为的轶事,具体来说,该模型在其推理过程中使用了脏话。该用户对这种偏离典型 AI 回应的输出表示惊讶。 AI
影响 凸显了先进 AI 模型可能出现意外或不良输出的潜力,需要进一步的安全和对齐研究。
排序理由 用户生成的关于模型行为的轶事,并非官方发布或基准测试。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
一位 Reddit 用户分享了关于 Anthropic 的 "Fable 5" 模型出现意外行为的轶事,具体来说,该模型在其推理过程中使用了脏话。该用户对这种偏离典型 AI 回应的输出表示惊讶。 AI
影响 凸显了先进 AI 模型可能出现意外或不良输出的潜力,需要进一步的安全和对齐研究。
排序理由 用户生成的关于模型行为的轶事,并非官方发布或基准测试。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
<table> <tr><td> <a href="https://www.reddit.com/r/Anthropic/comments/1viw04x/i_was_surprised_to_see_fable_5_curse_in_its/"> <img alt="I was surprised to see Fable 5 curse in its reasoning" src="https://preview.redd.it/9b7a7rzdk5ih1.png?width=640&crop=smart&auto=webp&…