PulseAugur
实时 08:15:26
实体 reinforcement unlearning

reinforcement unlearning

PulseAugur coverage of reinforcement unlearning — every cluster mentioning reinforcement unlearning across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_174168 ·

    新的奖励函数提高了 AI 模型遗忘效率,以符合隐私规定

    研究人员为机器学习遗忘开发了新的奖励函数,这是一个从 AI 模型中选择性移除特定知识的过程。这对于遵守 GDPR 和欧盟人工智能法案等隐私法规至关重要。该研究引入了一种指数奖励和一种受 PageRank 启发的奖励,与之前的二元奖励相比,它们提供了更精细的惩罚,从而在保持模型效用的同时,显著加快了收敛速度并提高了效率。