1 paper
Thomas Bush, Stephen Chung, Usman Anwar +2
We present the first mechanistic evidence that model-free reinforcement learning agents can learn to plan. This is achieved by applying a methodology based on concept-based interpr…