1 paper · 1 filter
Ludvig Killingberg, Helge Langseth
Offline reinforcement learning (RL) leverages static datasets to learn decision policies without real-time environment interaction. While recent sequence-modeling approaches rely o…