1 paper
Kewei Xu, Junbo Qi, Yanyan Zou +3
Reinforcement learning (RL) presents a promising avenue for enhancing generative recommendation beyond supervised imitation, leveraging reward signals to guide policy improvement.…