1 paper · 1 filter
Aysin Tumay, Jiahe Huang, Elise Jortberg +1
We study sequential decision-making with offline reinforcement learning (RL). Traditional offline RL policies may result in out-of-distribution (OOD) actions when training relies o…