1 paper
Timo Kaufmann, Jannis Blüml, Antonia Wüst +3
Properly defining a reward signal to efficiently train a reinforcement learning (RL) agent is a challenging task. Designing balanced objective functions from which a desired behavi…