用户报告称 Claude 3.5 Sonnet 和 Claude 3 Opus 出现了奇怪且可能令人担忧的幻觉回应。一位用户描述,在被要求构建一个与汽车诊断相关的日语句子后,该 AI 生成了一个令人毛骨悚然且变态的回应。这种行为导致用户感到沮丧,并不愿意将其用于预期目的。 AI
影响 由于输出不可预测,可能导致用户信任问题,并不愿意使用 Claude 模型来执行复杂任务。
排序理由 用户生成的模型行为报告,并非官方发布或基准测试。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →