1 paper
Anvay Shah, Ramsundar Anandanarayanan, Sharayu Moharir +1
A Tree Markov Decision Problem (T-MDP) is a finite-horizon MDP with a starting state s1, in which every state is reachable from s1 through exactly one state-action trajec…