1 paper
Kazumune Hashimoto, Shunki Kimura, Kazunobu Serizawa +3
We study data-driven computation of probabilistic controlled invariant sets (PCIS) for safety-critical reinforcement learning under unknown dynamics. Assuming a linear MDP model, w…