1 paper · 1 filter
Tyler Clark, Christine Evers, Jonathon Hare
Recurrent off-policy deep reinforcement learning models achieve state-of-the-art performance but are often sidelined due to their high computational demands. In response, we introd…