数据科学家Mohd Faraaz发现,包括ChatGPT、Gemini、Claude、DeepSeek、Llama和Qwen在内的六个主要大型语言模型,在被要求从1到50之间选择一个随机数字时,一致偏爱数字27。只有Grok例外,选择了42。马德里的Javier Coronado-Blázquez进行的进一步测试证实,这些模型确实存在偏爱的数字,且更大的模型在这方面没有改进,甚至可能表现更差。这种现象发生的原因是,大型语言模型将数字视为文本字符串而非数量,并且其概率生成过程难以确保选择的均匀分布。 AI
影响 大型语言模型表现出非随机的数字生成偏见,表明其在理解量化概念方面存在局限性。
排序理由 该条目讨论了关于大型语言模型行为的非技术性观察,而非新的发布、研究论文或政策变更。
- AI Garden
- ChatGPT
- Claude
- DeepSeek
- Gemini
- Grok
- Javier Coronado-Blázquez
- llama
- Mohd Faraaz
- Qwen
- Veritasium
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →