1 paper
Yu Zhang, Yunqi Li, Yifan Yang +7
Although chain-of-thought reasoning and reinforcement learning (RL) have driven breakthroughs in NLP, their integration into generative vision models remains underexplored. We intr…