1 paper · 1 filter
Yihang Chen, Yuanhao Ban, Yunqi Hong +1
Despite the success of Reinforcement Learning from Human Feedback (RLHF) in language reasoning, its application to autoregressive Text-to-Image (T2I) generation is often constraine…