Rui Li
PulseAugur coverage of Rui Li — every cluster mentioning Rui Li across labs, papers, and developer communities, ranked by signal.
-
New framework TaRoS tackles reward signal issues in video generation GRPO
Researchers have introduced TaRoS, a novel framework designed to improve reward signaling in Group Relative Policy Optimization (GRPO) for video generation. This new approach addresses issues like shortcut-driven optimi…
-
Researchers propose RATS framework for faster, higher-quality visual generation
Researchers have developed a new framework called Reward-Aware Trajectory Shaping (RATS) to improve the efficiency and quality of visual generation models. RATS allows models to optimize for preferred generation quality…
-
Researchers propose Objective-aware Trajectory Credit Assignment for visual generation
Researchers have developed a new framework called Objective-aware Trajectory Credit Assignment (OTCA) to improve the training of visual generative models using reinforcement learning. Current methods often assign reward…