3 papers
cs.LG2026
Provably Safe Reinforcement Learning for Stochastic Reach-Avoid Problems with Entropy Regularization
Abhijit Mazumdar, Rafal Wisniewski, Manuela L. Bujorianu
We consider the problem of learning the optimal policy for Markov decision processes with safety constraints. We formulate the problem in a reach-avoid setup. Our goal is to design…
eess.SY2025
An Online Multiobjective Policy Gradient for Long-run Average-reward Markov Decision Process
Rahul Misra, Manuela L. Bujorianu, Rafał Wisniewski
We propose a reinforcement learning (RL) framework for multi-objective decision-making, where the agent seeks to optimize a vector of rewards rather than a single scalar value. The…
eess.SY2024
Distributionally Robust Safety Verification for Markov Decision Processes
Abhijit Mazumdar, Yuting Hou, Rafal Wisniewski
In this paper, we propose a distributionally robust safety verification method for Markov decision processes where only an ambiguous transition kernel is available instead of the p…