实体
BioSecBench-Refusal
BioSecBench-Refusal
PulseAugur coverage of BioSecBench-Refusal — every cluster mentioning BioSecBench-Refusal across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
xAI的Grok 4.6在生物安全评估中领先,表现优于同类模型
xAI的Grok 4.6在LatchBio进行的生物安全评估中表现出卓越的性能。该模型在LatchBio的BioSecBench-Refusal套件上表现出色,显示出区分合法生物研究和危险请求的强大能力,同时在常规生物任务上保持高性能。尽管Grok 4.6在生物监测任务上的表现与其他前沿模型相当,但其对伪装的危险查询的拒绝率却显著更高。
-
新基准评估AI拒绝危险生物学任务的能力
开发了一个名为BioSecBench-Refusal的新基准,用于评估AI代理在生物学研究环境中识别风险和拒绝的能力。该基准包括合法的研究任务和旨在隐藏生物安全危害的虚构场景。在各种模型配置中,拒绝率差异很大,一些模型错误地拒绝了合法的任务,同时未能识别隐藏的威胁。研究表明,虽然API过滤器可以触发拒绝,但具有更强推理能力的AI模型在识别现实世界风险方面显示出潜力。