PulseAugur
实时 07:42:48
实体 Kaixuan Wang

Kaixuan Wang

PulseAugur coverage of Kaixuan Wang — every cluster mentioning Kaixuan Wang across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_233475 ·

    新基准测试揭示大型语言模型在减害信息方面存在安全风险

    一项名为HarmReduction的新基准测试已被开发出来,用于评估大型语言模型(LLMs)在为药物使用者提供减害信息的准确性和安全性。该基准测试包含2,160个问答证据对,涵盖三个任务:评估安全边界、提供定量数据以及推断多物质使用风险。初步结果表明,当前最先进的大型语言模型在准确性方面存在困难,并且可能对寻求此类敏感信息的用户构成重大的安全风险。