1 paper · 1 filter
Trevor Ablett, Bryan Chan, Jayce Haoran Wang +1
Common approaches to providing feedback in reinforcement learning are the use of hand-crafted rewards or full-trajectory expert demonstrations. Alternatively, one can use examples…