1 paper
Merve Atasever, Cagan Bakirci, Alfredo Reina Corona +2
Reinforcement learning (RL) for quadruped locomotion commonly depends on fixed, hand-crafted, and Markovian reward functions that limit both interpretability of learned policies an…