一项实验显示,ChatGPT(特别是 GPT-5.6-Luna 模型)在被要求从列表中随机选择水果时表现出有偏见的行为。在英语、波兰语和日语的 6,000 次试验中,即使列表被随机打乱,该模型也始终偏爱少数几种水果。这表明该模型在此类任务的输出中缺乏真正的随机性。 AI
影响 凸显了 LLM 输出在感知随机性和一致性方面可能存在的局限性。
排序理由 用户进行的关于模型行为的实验。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →