1 paper
Farzan Memarian, Wonjoon Goo, Rudolf Lioutikov +2
We introduce Self-supervised Online Reward Shaping (SORS), which aims to improve the sample efficiency of any RL algorithm in sparse-reward environments by automatically densifying…