1 paper
Ruopeng Cui, Yifei Bi, Haojie Luo +1
Reinforcement learning necessitates meticulous reward shaping by specialists to elicit target behaviors, while imitation learning relies on costly task-specific data. In contrast,…