1 paper · 1 filter
Andrew Choi, Wei Xu
Offline-to-online reinforcement learning (RL) improves sample efficiency by leveraging pre-collected datasets prior to online interaction. A key challenge, however, is learning an…