1 paper
Jiayu Yao, Weiwei Pan, Finale Doshi-Velez +1
In this work, we study an inverse reinforcement learning (IRL) problem where the experts are planning under a shared reward function but with different, unknown planning horizons.…