1 paper
Xinming Gao, Shangzhe Li, Yujin Cai +1
Offline reinforcement learning (RL) enables policy learning from fixed datasets without further environment interaction, making it particularly valuable in high-risk or costly doma…