1 paper
Mengmeng Li, Daniel Kuhn, Tobias Sutter
We propose policy gradient algorithms for robust infinite-horizon Markov decision processes (MDPs) with non-rectangular uncertainty sets, thereby addressing an open challenge in th…