1 paper
Songyi Gao, Zuolin Tu, Rong-Jun Qin +3
Offline reinforcement learning (RL) aims to learn from historical data without requiring (costly) access to the environment. To facilitate offline RL research, we previously introd…