1 paper · 1 filter
Umer Siddique, Peilang Li, Conor Wallace +1
Deep reinforcement learning (RL) agents achieve strong performance by optimizing scalar reward functions. However, once deployed, the policies of these RL agents are often rigid an…