实体
Bradley--Terry
Bradley--Terry
PulseAugur coverage of Bradley--Terry — every cluster mentioning Bradley--Terry across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
研究:临床医生偏好是LLM临床安全性的糟糕代理指标
一篇新研究发表在arXiv上,题为“偏好而非安全:成对偏好是临床安全性的糟糕代理指标”,调查了临床医生成对偏好在评估大型语言模型(LLM)临床安全性方面的可靠性。该研究分析了来自736多名临床医生的26,000多项判断,发现高度偏好排名靠前的模型常常仍然表现出显著的临床不安全或误导性内容。这些安全故障在不同医学专科之间并不统一,并且可能被汇总排名所掩盖。研究表明,评估实践应区分偏好和安全性,直接报告安全关键的故障率,并纳入用于医疗决策…
-
新AI模型以注意力限制重新评估人类反馈
一篇新研究论文介绍了一种名为“注意力有限奖励学习”(Attention Limited Reward Learning)的模型,该模型重新审视了AI系统如何通过成对比较从人类偏好中学习。与假设直接奖励差异的标准方法不同,该模型融入了理性忽视的概念,认为比较可能因为价值的真正接近或在注意力有限的情况下难以区分而变得困难。论文认为,这种有限的注意力会扭曲排名,而被动比较数据可能无法区分奖励、注意力和默认倾向。对Chatbot Arena数…