2 papers
cs.LG2024
Structure Matters: Dynamic Policy Gradient
Sara Klein, Xiangyuan Zhang, Tamer BaÅar +2
In this work, we study -discounted infinite-horizon tabular Markov decision processes (MDPs) and introduce a framework called dynamic policy gradient (DynPG). The framework dir…
eess.SY2024
Controlgym: Large-Scale Control Environments for Benchmarking Reinforcement Learning Algorithms
Xiangyuan Zhang, Weichao Mao, Saviz Mowlavi +2
We introduce controlgym, a library of thirty-six industrial control settings, and ten infinite-dimensional partial differential equation (PDE)-based control problems. Integrated wi…