一项新的研究论文探讨了使用大型语言模型(LLMs)作为人类调查受访者的代理,发现其生成的品味是人类偏好的风格化和有偏见的仿制品。该研究利用OpenAI、Anthropic和DeepSeek的模型,为艺术公众参与调查(SPPA)创建了近277,500个“硅基代理”。主要发现表明,这些LLM生成的响应表现出积极的喜爱偏见,失去了人类品味中存在的复杂关系结构,并扭曲了文化、年龄、阶级、性别和种族之间已知的关联。 AI
影响 强调了在使用LLM进行调查数据收集时可能存在的偏见和不准确性,并警告不要过度依赖合成受访者。
排序理由 一篇在arXiv上发表的研究论文,详细介绍了关于LLM行为的发现。
- alphaXiv
- Anthropic
- arXiv
- CatalyzeX Code Finder for Papers
- CORE Recommender
- DagsHub
- DeepSeek
- Gotit.pub
- Hugging Face
- Influence Flower
- OpenAI
- ScienceCast
- Survey of Public Participation in the Arts (SPPA)
- WEIRD
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →