1 paper · 1 filter
Chang Chen, Junyeob Baek, Fei Deng +3
Despite the recent advancements in offline RL, no unified algorithm could achieve superior performance across a broad range of tasks. Offline \textit{value function learning}, in p…