1 paper
Haidong Huang, Haiyue Zhu. Jiayu Song, Xixin Zhao +4
Offline-to-online reinforcement learning (O2O-RL) has emerged as a promising paradigm for safe and efficient robotic policy deployment but suffers from two fundamental challenges:…