PulseAugur
实时 07:47:04
实体 Quanhao Li

Quanhao Li

PulseAugur coverage of Quanhao Li — every cluster mentioning Quanhao Li across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_252178 ·

    DiffusionOPD通过在线策略蒸馏增强扩散模型中的多任务学习

    研究人员推出了一种新颖的扩散模型训练范式DiffusionOPD,该范式利用在线策略蒸馏(OPD)来增强多任务学习。该方法独立训练特定任务的教师模型,然后将它们的能力蒸馏到一个单一的学生模型中。DiffusionOPD将OPD扩展到连续状态马尔可夫过程,提供了一个封闭形式的KL目标,统一了随机和确定性细化。实验表明,DiffusionOPD在训练效率和最终性能方面均优于现有的多奖励和级联RL基线。