1 paper · 1 filter
Wenzheng Shu, Yanxiang Zeng, Yongxiang Tang +6
Offline reinforcement learning (RL) has emerged as a prevalent and effective methodology for real-world recommender systems, enabling learning policies from historical data and cap…