1 paper
Mohammad Saif Nazir, Chayan Banerjee
Reinforcement learning (RL) often struggles with reward misalignment, where agents optimize given rewards but fail to exhibit the desired behaviors. This arises when the reward fun…