1 paper · 1 filter
Qingkai Liang, Fanyu Que, Eytan Modiano
Constrained Markov Decision Process (CMDP) is a natural framework for reinforcement learning tasks with safety constraints, where agents learn a policy that maximizes the long-term…