1 paper · 1 filter
Kris De Asis, Mohamed Elsayed, Jiamin He
Differential temporal difference (TD) methods are value-based reinforcement learning algorithms that have been proposed for infinite-horizon problems. They rely on reward centering…