1 paper
Jingxiao Chen, Weiji Xie, Weinan Zhang +2
Offline Reinforcement Learning (RL) enables policy improvement from fixed datasets without online interactions, making it highly suitable for real-world applications lacking effici…