1 paper
Xiaofeng Lin, Xuezhou Zhang
In this paper, we study reinforcement learning in Markov Decision Processes with Probabilistic Reward Machines (PRMs), a form of non-Markovian reward commonly found in robotics tas…