1 paper
Rasmus Larsen, Mikkel Nørgaard Schmidt
Reinforcement learning policies are often represented by neural networks, but programmatic policies are preferred in some cases because they are more interpretable, amenable to for…