1 paper
Siyuan Li, Shijie Han, Yingnan Zhao +2
Reinforcement learning (RL) has shown its strength in challenging sequential decision-making problems. The reward function in RL is crucial to the learning performance, as it serve…