1 paper · 1 filter
Charles A. Hepburn, Yue Jin, Giovanni Montana
Traditional offline reinforcement learning (RL) methods predominantly operate in a batch-constrained setting. This confines the algorithms to a specific state-action distribution p…