1 paper
Sili Huang, Jifeng Hu, Zhejian Yang +5
Recent works have shown the remarkable superiority of transformer models in reinforcement learning (RL), where the decision-making problem is formulated as sequential generation. T…