1 paper
Yen-Ru Lai, Fu-Chieh Chang, Pei-Yuan Wu
Offline reinforcement learning (RL) learns policies from a fixed dataset, but often requires large amounts of data. The challenge arises when labeled datasets are expensive, especi…