一项未经同行评审的独立评估,在八个基准测试中评估了六个前沿LLM在政治、性别和种族方面的偏见。研究发现,包括Grok 4.3在内的大多数模型在政治分类任务上表现出偏向左翼的倾向,这与Grok自我报告的政治倾向相反。在BBQ数据集上,GPT-5.4在被问及与种族相关的问题时表现出最高的拒绝率,而Claude Opus 4.7的拒绝率也相当显著。 AI
影响 强调了领先LLM中潜在的偏见,让开发者和用户了解模型的行为。
排序理由 评估LLM偏见的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →