1 paper
Sara Klein, Xiangyuan Zhang, Tamer Başar +2
In this work, we study γ-discounted infinite-horizon tabular Markov decision processes (MDPs) and introduce a framework called dynamic policy gradient (DynPG). The framework dire…