一个名为审议式民意调查诊断框架(Deliberative Polling Diagnostic Framework)的新框架被引入,用于评估大型语言模型(LLMs)在接收新信息后如何更新其信念,这项能力对于它们模拟公众舆论至关重要。与以往的静态评估不同,该框架通过在相同的干预信息后比较人类和大型语言模型的信念转变来评估动态保真度。对五种前沿模型——GPT-5.1、Gemini 2.0 Flash、Claude Sonnet 4.5、Llama 3.3-70B 和 DeepSeek-V3 的测试表明,所有模型都未能准确模仿人类的审议过程,表现出信念逆转、过度反应或僵化等问题,这种现象被称为“自我谄媚”。 AI
影响 这项研究突显了大型语言模型在推理和信念更新方面的关键局限性,表明当前模型在模拟细微的公众舆论方面不可靠,可能需要显著改进其动态保真度。
排序理由 学术论文,介绍了一个用于大型语言模型的新评估框架。[lever_c_demoted from research: ic=1 ai=1.0]
- America in One Room
- Claude Sonnet 4.5
- DeepSeek-V3
- Deliberative Polling Diagnostic Framework
- Gemini 2.0 Flash
- GPT-5.1
- Llama 3.3-70B
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →