1 paper · 1 filter
Himanshu Sahni, Toby Buckley, Pieter Abbeel +1
Reinforcement Learning (RL) algorithms typically require millions of environment interactions to learn successful policies in sparse reward settings. Hindsight Experience Replay (H…