PulseAugur
中
实时 19:42:03
实体 Zhengyan Wang

Zhengyan Wang

PulseAugur coverage of Zhengyan Wang — every cluster mentioning Zhengyan Wang across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_277353 ·

    新的强化学习框架增强了用于图像生成的离散流模型

    研究人员推出了一种新颖的强化学习框架 dFlowGRPO,专为离散流模型设计。这类生成模型包括扩散大型语言模型 (dLLMs)。该框架通过将去噪过程公式化为马尔可夫决策过程,统一了强化学习在更广泛的离散流模型中的应用。当应用于 FUDOKI 多模态离散流模型时,dFlowGRPO 在文本到图像生成方面表现出优于现有 dLLMs 的 GRPO 方法,并取得了与连续流模型相媲美的结果。