1 paper · 1 filter
Edwin Hamel-De le Court, Francesco Belardinelli, Alexander W. Goodall
In real-life scenarios, a Reinforcement Learning (RL) agent aiming to maximise their reward, must often also behave in a safe manner, including at training time. Thus, much attenti…