1 paper
Yunxiang Li, Mark Schmidt, Reza Babanezhad +1
Temporal difference (TD) learning is a fundamental algorithm for estimating value functions in reinforcement learning. Recent finite-time analyses of TD with linear function approx…