1 paper · 1 filter
Jérôme Arjonilla, Abdallah Saffidine, Tristan Cazenave
With the aim of improving performance in Markov Decision Problem in an Off-Policy setting, we suggest taking inspiration from what is done in Offline Reinforcement Learning (RL). I…