1 paper
Wenjia Meng, Qian Zheng, Long Yang +2
Policy-based methods have achieved remarkable success in solving challenging reinforcement learning problems. Among these methods, off-policy policy gradient methods are particular…