1 paper · 1 filter
Weizhen Wang, Jianping He, Xiaoming Duan
Policy gradient methods are one of the most successful approaches for solving challenging reinforcement learning problems. Despite their empirical successes, many state-of-the-art…