PulseAugur
实时 08:06:45
实体 DeHarm-Score

DeHarm-Score

PulseAugur coverage of DeHarm-Score — every cluster mentioning DeHarm-Score across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_156283 ·

    新基准SciHazard衡量大型语言模型科学安全风险

    研究人员推出SciHazard,这是一个旨在评估大型语言模型(LLM)带来的科学安全风险的新基准。该基准通过将查询与现实世界危害联系起来,并采用一种称为DeHarm-Score的分解危害评分系统,来解决现有方法的局限性。DeHarm-Score评估查询危害的严重性、拒绝行为以及响应级别的风险,包括可执行性和净新风险。对31个前沿LLM和深度研究代理进行的初步基准测试显示,自主代理构成了重大的安全隐患,其DeHarm-Scores高于标准LLM。