1 paper
Yang Fu, Haomin Bao, Rohit Sonker +4
Offline reinforcement learning (RL) offers a promising route for developing plasma controllers from historical tokamak data, since online trial-and-error on real devices is costly…