研究人员开发了 WinoQueer-NL,这是一个旨在评估荷兰语模型在 LGBTQ+ 身份方面偏见的新数据集。该数据集改编自英文 WinoQueer 基准测试,并通过对 43 名荷兰酷儿参与者的调查进行了验证,包含超过 42,000 个句子。使用各种荷兰语和多语言模型进行的初步评估显示,尽管平均偏见得分为中性,但特定模型表现出显著偏见,特别是针对跨性别者和非二元性别者,对跨性别身份的刻板印象句子偏好率高达 97%。 AI
影响 强调了需要特定文化的数据集来识别和减轻 AI 模型中的偏见,特别是对边缘化社区的影响。
排序理由 该集群描述了一篇介绍用于评估语言模型偏见的数据集的新学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Daily Papers 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →