1 paper
Ahana Deb, Roberto Cipollone, Anders Jonsson +2
This work studies offline Reinforcement Learning (RL) in a class of non-Markovian environments called Regular Decision Processes (RDPs). In RDPs, the unknown dependency of future o…