1 paper · 1 filter
Aman Mehra, Alexandre Capone, Jeff Schneider
A long-standing problem in online reinforcement learning (RL) is of ensuring sample efficiency, which stems from an inability to explore environments efficiently. Most attempts at…