一项新的研究论文详细介绍了大型语言模型 (LLM) 如何用于分析 150 多年来德国议会关于移民的辩论。研究发现,虽然像 GPT-5 和 gpt-oss-120B 这样的 LLM 可以达到与人类一致性相当的标注准确率,但其系统性错误需要进行统计校正才能进行可靠的长期趋势分析。研究追溯了近十年来,特别是自 2015 年以来,从战后对移民的团结转向日益增长的反团结的转变。 AI
影响 展示了 LLM 在大规模社会科学研究方面的能力,同时强调了对其输出进行严格验证和统计校正的必要性。
排序理由 学术论文,详细介绍了使用 LLM 进行社会科学研究的方法和发现。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →