3 citations · 6 across the 11 of their papers we have counts for
1 paper · 2 filters
Yiyang Wang, Xi Chen, Xiaogang Xu +2
Recent advancements adopt online reinforcement learning (RL) from LLMs to text-to-image rectified flow diffusion models for reward alignment. The use of group-level rewards success…