1 paper · 1 filter
Tianjiao Luo, Tim Pearce, Huayu Chen +2
Generative Adversarial Imitation Learning (GAIL) trains a generative policy to mimic a demonstrator. It uses on-policy Reinforcement Learning (RL) to optimize a reward signal deriv…