1 paper
Luca Furieri, Sucheth Shenoy, Danilo Saccani +2
We introduce magnitude and direction (MAD) policies, a policy parameterization for reinforcement learning (RL) that preserves Lp closed-loop stability for nonlinear dynamical syste…