1 paper · 1 filter
Tom Bewley, Jonathan Lawry, Arthur Richards +2
Recent efforts to learn reward functions from human feedback have tended to use deep neural networks, whose lack of transparency hampers our ability to explain agent behaviour or v…