1 paper
Ishan Durugkar, Mauricio Tec, Scott Niekum +1
Learning with an objective to minimize the mismatch with a reference distribution has been shown to be useful for generative modeling and imitation learning. In this paper, we inve…