1 paper · 1 filter
Alex Beeson, Giovanni Montana
Offline reinforcement learning agents seek optimal policies from fixed data sets. With environmental interaction prohibited, agents face significant challenges in preventing errors…