1 paper
Walid Bendada, Guillaume Salha-Galvan, Romain Hennequin +3
This paper introduces von Mises-Fisher exploration (vMF-exp), a scalable method for exploring large action sets in reinforcement learning problems where hyperspherical embedding ve…