3 citations · 9 across the 6 of their papers we have counts for
1 paper · 1 filter
Jonathan N. Lee, George Tucker, Ofir Nachum +2
In offline reinforcement learning (RL), a learner leverages prior logged data to learn a good policy without interacting with the environment. A major challenge in applying such me…