1 paper
Amirreza Valaei, Arash Bahari Kordabad, Sadegh Soudjani
Policy gradient methods are a powerful family of reinforcement learning algorithms for continuous control that optimize a policy directly. However, standard first-order methods oft…