1 paper
Aaron M. Roth, Jing Liang, Ram Sriram +2
We present Multiple Scenario Verifiable Reinforcement Learning via Policy Extraction (MSVIPER), a new method for policy distillation to decision trees for improved robot navigation…