1 paper
Yancheng Zhu, Wanli Ma, Chen Han +3
Reinforcement-learning navigation policies for legged robots select actions reactively from current observations and short-term memory, with limited capacity to anticipate how movi…