1 paper
Ning Wei, Jiahua Liang, Di Xie +1
Designing optimal reward functions has been desired but extremely difficult in reinforcement learning (RL). When it comes to modern complex tasks, sophisticated reward functions ar…