1 paper
Anton Matsson, Yaochen Rao, Heather J. Litman +1
Offline reinforcement learning (RL) holds great promise for deriving optimal policies from observational data, but challenges related to interpretability and evaluation limit its p…