1 paper
Tan Jing, Xiaorui Li, Chao Yao +4
Offline reinforcement learning (RL) enables learning effective policies from fixed datasets without any environment interaction. Existing methods typically employ policy constraint…