1 paper
Aoi Yoshimura, Gouhei Tanaka
Reinforcement learning (RL) policies trained in simulation often suffer from severe performance degradation when deployed in real-world environments due to non-stationary dynamics.…