PulseAugur
实时 21:09:50
实体 Workshop on Artificial Intelligence Safety 2022 (AISafety 2022)

Workshop on Artificial Intelligence Safety 2022 (AISafety 2022)

PulseAugur coverage of Workshop on Artificial Intelligence Safety 2022 (AISafety 2022) — every cluster mentioning Workshop on Artificial Intelligence Safety 2022 (AISafety 2022) across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. COMMENTARY · CL_176557 ·

    AI安全倡导者敦促公众就AI“紧急停止开关”法案联系国会

    一项行动呼吁敦促个人就AI“紧急停止开关”法案联系他们的国会议员。该信息强调了这项立法行动对AI安全的重要性,并包含一个指向YouTube视频的链接以获取更多信息。

  2. TOOL · CL_125945 ·

    AI模型即使在数据被标记为虚假时也会学习虚假声明

    一篇新论文表明,在微调数据中标记虚假或有害文本并不能阻止模型学习和断言这些虚假信息。即使文档反复警告某项声明是捏造的,模型仍有可能以高概率将其呈现为真实。这种“否定忽略”也适用于行为训练,表明存在重大的数据投毒风险,即模型会学习恶意指令,尽管有明确标记。