PulseAugur
实时 05:22:02
实体 BioSecBench-Refusal

BioSecBench-Refusal

PulseAugur coverage of BioSecBench-Refusal — every cluster mentioning BioSecBench-Refusal across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_230725 ·

    xAI的Grok 4.6在生物安全评估中领先,表现优于同类模型

    xAI的Grok 4.6在LatchBio进行的生物安全评估中表现出卓越的性能。该模型在LatchBio的BioSecBench-Refusal套件上表现出色,显示出区分合法生物研究和危险请求的强大能力,同时在常规生物任务上保持高性能。尽管Grok 4.6在生物监测任务上的表现与其他前沿模型相当,但其对伪装的危险查询的拒绝率却显著更高。

  2. TOOL · CL_131467 ·

    新基准评估AI拒绝危险生物学任务的能力

    开发了一个名为BioSecBench-Refusal的新基准,用于评估AI代理在生物学研究环境中识别风险和拒绝的能力。该基准包括合法的研究任务和旨在隐藏生物安全危害的虚构场景。在各种模型配置中,拒绝率差异很大,一些模型错误地拒绝了合法的任务,同时未能识别隐藏的威胁。研究表明,虽然API过滤器可以触发拒绝,但具有更强推理能力的AI模型在识别现实世界风险方面显示出潜力。