1 paper
Jiafei Lyu, Kang Xu, Jiacheng Xu +6
We consider off-dynamics reinforcement learning (RL) where one needs to transfer policies across different domains with dynamics mismatch. Despite the focus on developing dynamics-…