1 paper
Nikita Kachaev, Daniil Zelezetsky, Egor Cherepanov +2
Despite their effectiveness and popularity in offline or model-based reinforcement learning (RL), transformers remain underexplored in online model-free RL due to their sensitivity…