1 paper
Tom Bewley, Jonathan Lawry, Arthur Richards +2
Recent efforts to learn reward functions from human feedback have tended to use deep neural networks, whose lack of transparency hampers our ability to explain agent behaviour or v…