一项名为 JuryBench 的新基准已被开发出来,用于研究在美国刑事法律案件中,大型语言模型模拟的陪审员如何受到被告陈述的影响。该研究分析了来自 20 个前沿大型语言模型的超过 432,000 个判决,发现情感说服会对感知到的罪责产生负面影响,并且被告与陪审员之间的背景亲和力是量刑的重要因素。意识形态在塑造严重性判断方面也起着重要作用,这既揭示了使用大型语言模型模拟陪审员推理的潜力,也揭示了其风险。 AI
影响 强调了大型语言模型模拟法律决策中存在的潜在偏见,为开发更公平的人工智能系统提供了信息。
排序理由 学术论文,介绍了一个新的基准和对大型语言模型行为的分析。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →