1 paper
Zetian Sun, Dongfang Li, Zhuoen Chen +2
Reward sparsity in long-horizon reinforcement learning (RL) tasks remains a significant challenge, while existing outcome-based reward shaping struggles to define meaningful immedi…