1 paper
Jiin Woo, Laixi Shi, Gauri Joshi +1
Offline reinforcement learning (RL), which seeks to learn an optimal policy using offline data, has garnered significant interest due to its potential in critical applications wher…