PulseAugur
实时 08:13:21
实体 ROPD

ROPD

PulseAugur coverage of ROPD — every cluster mentioning ROPD across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_171853 ·

    新的ROPD框架增强了LLM对抗对抗性提示的能力

    一篇新的研究论文介绍了一种基于路由的策略内蒸馏(ROPD)框架,旨在增强大型语言模型(LLM)的安全性和鲁棒性。ROPD解决了当前微调防御的局限性,例如灾难性遗忘和易受提示模板操纵的影响。通过模拟对齐输出和受损输出分布之间的差异,ROPD旨在在模型能力保持的同时,即使面对对抗性提示变体也能防止有害行为。

  2. RESEARCH · CL_21952 ·

    新方法增强LLM的On-Policy蒸馏

    研究人员开发了新方法来提高大型语言模型On-Policy蒸馏(OPD)的效率和稳定性。一种方法vOPD使用源自反向KL散度的控制变量基线,在没有显著计算开销的情况下降低梯度方差。另一种方法ROPD仅使用教师生成的响应即可实现基于规则的蒸馏,提供了基于logit的OPD的黑盒兼容替代方案。第三种技术Near-Policy Distillation(NPD)通过异步生成和选择性打包来加速该过程,实现了显著的加速并优于标准微调。