2 papers
cs.LG2024
Cache-Aware Reinforcement Learning in Large-Scale Recommender Systems
Xiaoshuang Chen, Gengrui Zhang, Yao Wang +4
Modern large-scale recommender systems are built upon computation-intensive infrastructure and usually suffer from a huge difference in traffic between peak and off-peak periods. I…
cs.IR2024
UNEX-RL: Reinforcing Long-Term Rewards in Multi-Stage Recommender Systems with UNidirectional EXecution
Gengrui Zhang, Yao Wang, Xiaoshuang Chen +3
In recent years, there has been a growing interest in utilizing reinforcement learning (RL) to optimize long-term rewards in recommender systems. Since industrial recommender syste…