1 paper
Teng Yan, Zhendong Ruan, Yaobang Cai +3
As a data-driven paradigm, offline reinforcement learning (Offline RL) has been formulated as sequence modeling, where the Decision Transformer (DT) has demonstrated exceptional ca…