1 paper · 1 filter
Dzmitry Bahdanau, Felix Hill, Jan Leike +4
Recent work has shown that deep reinforcement-learning agents can learn to follow language-like instructions from infrequent environment rewards. However, this places on environmen…