2 papers
cs.LG2025
Reward Guidance for Reinforcement Learning Tasks Based on Large Language Models: The LMGT Framework
Yongxin Deng, Xihe Qiu, Jue Chen +1
The inherent uncertainty in the environmental transition model of Reinforcement Learning (RL) necessitates a delicate balance between exploration and exploitation. This balance is…
cs.IR2025
FedSlate:A Federated Deep Reinforcement Learning Recommender System
Yongxin Deng, Xihe Qiu, Xiaoyu Tan +1
Reinforcement learning methods have been used to optimize long-term user engagement in recommendation systems. However, existing reinforcement learning-based recommendation systems…