1 paper
Yang Chen, Menglin Zou, Jiaqi Zhang +6
Inverse Reinforcement Learning (IRL) learns a reward function to explain expert demonstrations. Modern IRL methods often use the adversarial (minimax) formulation that alternates b…