1 paper
Yiqing Xu, Finale Doshi-Velez, David Hsu
Inverse reinforcement learning (IRL) algorithms often rely on (forward) reinforcement learning or planning, over a given time horizon, to compute an approximately optimal policy fo…