一项新的研究论文探讨了是否可以使用类似 Cards Against Humanity 的任务,让一个大型语言模型预测另一个模型的幽默偏好。该研究将 GPT-4o 与 Claude Opus 4.5 进行对比,发现简单的模仿指令只能带来微小的改进,而提供其他模型选择的行为证据,尤其是附带理由,则能显著提高准确性。这表明一种类似心智理论的行为,模型可以根据观察到的偏好调整其响应,而不是内化它们。 AI
影响 展示了大型语言模型可以表现出类似心智理论的行为,有望改善代理协作和个性化人工智能交互。
排序理由 该集群包含一篇详细介绍大型语言模型能力实验的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- Cards Against Humanity
- CatalyzeX
- Claude Opus 4.5
- CORE Recommender
- DagsHub
- Gotit.pub
- GPT-4o
- Hugging Face
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →