1 paper
Jinxin Liu, Ziqi Zhang, Zhenyu Wei +4
Offline reinforcement learning (RL) aims to learn a policy using only pre-collected and fixed data. Although avoiding the time-consuming online interactions in RL, it poses challen…