1 paper
Xuefeng Liu, Takuma Yoneda, Chaoqi Wang +2
Reinforcement learning (RL) has made significant strides in various complex domains. However, identifying an effective policy via RL often necessitates extensive exploration. Imita…