1 paper · 1 filter
William Sharpless, Dylan Hirsch, Sander Tonkens +2
Hard constraints in reinforcement learning (RL) often degrade policy performance. Lagrangian methods offer a way to blend objectives with constraints, but require intricate reward…