PulseAugur
实时 15:08:15
实体 Marco Antonio Stranisci

Marco Antonio Stranisci

PulseAugur coverage of Marco Antonio Stranisci — every cluster mentioning Marco Antonio Stranisci across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. RESEARCH · CL_72542 ·

    研究发现:语言模型过滤器导致认识论不公

    一篇新发表在arXiv上的研究论文详细介绍了语言模型中的预训练过滤器和护栏如何导致认识论不公。审计发现,这些系统不成比例地标记与边缘化群体相关的内容,例如跨性别者、女性和中美洲人,但却常常未能检测到露骨的仇恨言论或私人信息。人工标注者会保留这些自动化系统标记的大部分内容,这凸显了它们在捕捉细微的代表性伤害方面的能力差距。

  2. TOOL · CL_68419 ·

    新框架分析内容审核中的大型语言模型偏见

    研究人员开发了一个名为“幽灵标注器”的新框架,用于分析内容审核任务中人类标注的变异性,特别是在使用大型语言模型进行标注时。该框架结合了一致性预测和协同过滤,以模拟大型语言模型相对于人类标注者的行为,识别模型预测与人类共识不符的情况。研究发现,较大的大型语言模型在对与任何人类标注都不符的内容进行分类时往往更自信,并揭示了人口统计学不匹配的一致模式,这表明预训练数据中存在偏见。