1 paper
JaeYoon Kim, Junyu Xuan, Christy Liang +1
Offline-to-online reinforcement learning (RL) leverages both pre-trained offline policies and online policies trained for downstream tasks, aiming to improve data efficiency and ac…