PulseAugur
实时 06:40:43
实体 SDARE-Bench

SDARE-Bench

PulseAugur coverage of SDARE-Bench — every cluster mentioning SDARE-Bench across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_231553 ·

    新基准揭示大型语言模型难以应对对话污名

    一个名为 SDARE-Bench 的新基准已被开发出来,用于评估大型语言模型 (LLM) 在检测和响应对话污名方面的能力。该基准包含 1,138 个二元查询和 1,388 个群体对话场景。对八个 LLM 的初步测试显示,它们在识别污名方面存在显著弱点,尤其是在群体对话中,模型还表现出更高的污名表达率,并提供不太真实的建议。在模拟的群体压力场景中,LLM 在 97.5% 的响应中表达了污名,凸显了关键的安全漏洞。