1 paper · 1 filter
Merve Atasever, Keyan Azbijari, Cagan Bakirci +5
Quadruped robot locomotion policies are often trained using reinforcement learning, which in turn relies heavily on hand-crafted reward functions. Designing reward functions requir…