1 paper
Abhilash Reddy Chenreddy, Erick Delage
Offline reinforcement learning learns policies from fixed datasets without further environment interaction. A key challenge in this setting is epistemic uncertainty, arising from l…