2 papers
cs.LG2025
Action-Dependent Optimality-Preserving Reward Shaping
Grant C. Forbes, Jianxun Wang, Leonardo Villalobos-Arias +2
Recent RL research has utilized reward shaping--particularly complex shaping rewards such as intrinsic motivation (IM)--to encourage agent exploration in sparse-reward environments…
cs.LG2024
Potential-Based Reward Shaping For Intrinsic Motivation
Grant C. Forbes, Nitish Gupta, Leonardo Villalobos-Arias +3
Recently there has been a proliferation of intrinsic motivation (IM) reward-shaping methods to learn in complex and sparse-reward environments. These methods can often inadvertentl…