1 paper
Cinjon Resnick, Roberta Raileanu, Sanyam Kapoor +3
Model-free reinforcement learning (RL) requires a large number of trials to learn a good policy, especially in environments with sparse rewards. We explore a method to improve the…